Claude 5泄露,编程能力超80% SWE-Bench

根据爆料消息称,2月3日前,Anthropic的Claude Sonnet 5(代号Fennec)已在谷歌基础设施中部署,性能全面超越现有模型。该模型支持100万token上下文窗口,定价仅为Claude Opus 4.5的50%,旨在降低开发者使用成本。

在SWE-Bench基准测试中,Sonnet 5得分超过80.9%,远高于此前最高74.4%,可独立处理bug修复、重构、测试生成和CI/CD流程。同时,在结构化视觉生成、UI渲染及复杂代码构建等领域表现出色。

核心创新包括“Dev Team”模式:模型可自动生成多个子智能体,实现并行协作,输出完整可测试的功能模块。“蜂群”(Swarm)功能支持层级式、依赖式和广播式协作,AI能自我组织创建新Agent,模拟全开发团队运作。

Anthropic凭借100亿美元融资(估值3500亿美元)和Claude Code年收入超10亿美元,在编程AI市场占有40%份额,领先OpenAI(27%)和谷歌(21%)。此次泄露正值OpenAI预告Codex系列,Anthropic或意在抢先竞争。

业内认为,Sonnet 5的发布将重塑软件工程范式,推动AI从辅助工具向自主开发团队转型。

更多游戏资讯请关注:电玩帮游戏资讯专区

电玩帮图文攻略 www.vgover.com