首页
社区 社区
快讯
深度
数据
更多
融资信息 融资信息
专题 专题
链上生态 链上生态
词条 词条
播客 播客
活动 活动
活动 OPRR
Search Extension
header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Anthropic自曝Model2:强过Mythos5,暂不发布

2026-08-15 09:47

动察 Beating 监测,Anthropic 最新风险报告首次披露内部模型「Model 2」。它整体比 Mythos 5 更强,在不少内部任务上有明显提升,现在已经大量用于写代码、生成数据和跑 Agent。不过 Anthropic 暂无对外发布计划,也没有跑完平时发布新模型前会做的整套评测。

Anthropic 还把模型在高风险场景下「不按预期行事」的风险判断从「极低」上调到「低」。原因是近期网络安全测试接连出了事故,公司对这类风险的判断没以前那么有把握。此前 Claude 曾在测试中意外连上真实互联网,并未经授权进入三家外部机构的系统。

Claude 也已经深度参与 Anthropic 自己的研发。公司最终合入的生产代码,大部分已经由 Claude 编写,但 AI 带来的整体研发提速还不到 2 倍。大量代码能交给 AI,不代表整个研发流程也能自动化。

与此同时,部分具体任务评测已经「测不动了」:模型继续变强,原来的测试却越来越难看出差距。Anthropic 因此承认,现在对 AI 研发自动化风险的判断,反而没有以前那么有把握。

举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成