Anthropic发布Model 2风险报告:内部超级模型超越Claude Mythos 5的秘密

0 阅读

Anthropic最新发布的第二份风险报告如同一面镜子,映射出前沿AI技术发展的复杂面貌。这份长达186页的文档不仅揭示了Model 2这一神秘内部模型的存在,更暴露了AI安全领域的深层挑战。在这个AI能力快速迭代的时代,实验室内部的真实边界与面向公众的产品线正在出现明显的分离趋势。

图片

Model 2作为Anthropic内部最强大的模型之一,其存在本身就具有重要意义。虽然官方并未透露具体的参数规模、训练成本或架构细节,但已知的信息足以让人感受到其强大实力。这款模型在编码、数据生成和智能体任务方面表现出色,已成为公司内部研发的重要工具。更重要的是,Model 2与Mythos 5并列为截至7月15日能力最强、内部使用最多的两个模型,这标志着Anthropic在AI能力发展上的重要里程碑。

图片

从性能指标来看,Model 2展现出了显著的优势。在CoBench评测中,该模型得分达到62.8%,远超Mythos 5的50.3%和Mythos Preview的54.8%。这套由449个真实研发问题组成的评测体系,要求模型在特定历史时间点下分析代码库、日志和文档,寻找问题根源。尽管Model 2距离全面替代技术人员所需的85%标准仍有差距,但其相对前代模型的大幅提升不容忽视。这种进步幅度虽然不及从Claude Opus 4.6跳到Mythos Preview时的跨越,但在技术成熟度较高的阶段,这样的提升同样具有重要意义。

图片

Anthropic内部能力指数AECI的数据显示,Model 2比Mythos 5高出约1.5分,虽然误差区间较大,但这一增长趋势仍然值得关注。值得注意的是,2026年的Mythos系列明显偏离了此前的趋势线,这暗示着AI能力发展的加速态势。Model 2的出现进一步证实了这一趋势,同时也带来了新的挑战:如何在保持创新能力的同时确保安全性。

图片

Model 2的内部部署过程体现了Anthropic对风险管理的谨慎态度。该公司实施了分阶段部署策略,首先在带有更强危险行为阻断控制的内部界面上使用,逐步收集真实工作数据,然后再开放到限制较少的内部环境。这种做法虽然降低了初期风险,但也暴露出一个悖论:公司认为Model 2足以进入研发生产线,却又承认没有完成惯常的全部部署前测试。这种微妙的不对称反映了前沿AI技术发展中的现实困境。

图片

更值得关注的是,Model 2已经深度嵌入Anthropic的自我研发循环。报告显示,Claude现在编写了合入公司生产代码库的

图片

图片

图片

图片

图片

图片

图片