Anthropic发新模型,OpenAI同日预告新品将安全优先
当地时间9月1日,Anthropic宣布推出Claude Fable 5.1和Claude Mythos 5.1,并将其定位为世界上最先进的编程和知识工作模型。
略慢一步的OpenAI表示,最新模型Astra也将很快发布,但会将最先进的网络安全功能限于一小部分测试人员使用。Astra是OpenAI指定的第一个达到其关键网络安全能力阈值的模型。
另据市场消息,谷歌正在开发一款具有更强编码能力的新型人工智能模型,以缩小与OpenAI和Anthropic之间的差距。
头部厂商同一时间窗口密集释放新模型信号,标志着短暂“熄火”后的前沿模型更迭竞争再次提速。而与以往单纯比拼基准测试分数不同,本轮竞赛的另一条主线逐渐清晰:随着模型能力逼近网络安全关键门槛,厂商正集体将安全部署从后台议题推向前台。

Anthropic新模型性能跃升
通过榜单数据证明性能提升仍旧是常规动作。
据第三方测评平台Artificial Analysis数据,Claude Fable 5.1在人工智能分析智能指数中名列前茅。尽管缓存读取价格降低了75%,但每次任务的成本仍比Fable 5高出20%。
在前沿智能测试的各项基准中,Fable 5.1均实现提升:智能指数方面比Fable 5提升了4分;在HLE测试中得分为59.1%,超过了Claude Fable 5此前创下的55.5%的最高分;在Terminal-Bench v2.1(91.4%)和SciCode(62.0%)测试中均取得该平台迄今为止见过的最高分;在τ³-Banking测试中比Fable 5提升了9分。
价格层面,Anthropic将缓存读取(命中)价格从每百万token 1美元大幅下调至0.25美元,降幅达75%;标准定价则维持不变:输入每百万token 10美元、输出50美元、缓存写入12.5美元。这一调整将显著降低代理工作负载的成本。
缓存降价并未带来单次任务成本的同步下降。Fable 5.1(最高难度)的智能指数任务单次成本为3.76美元,较Fable 5高出20%,主因是它的输出token用量达到了后者的1.7倍。
缓存读取降价在智能体评估中为每次任务节省约1.40美元,这类场景大部分输入token都来自缓存命中。在xhigh难度下,Fable 5.1单次任务成本降至2.72美元,得分65,相比最高难度低1.04美元;但横向对比来看,仍高于Claude Opus 5在最高难度下的2.34美元(得分63)。
这一价格结构折射出前沿模型的成本逻辑正在发生微妙变化:输入侧的缓存降价意在降低智能体场景的调用门槛,但模型本身更强的推理深度意味着更长的输出链,最终单次任务的总成本不降反升。
对于重度依赖智能体工作流的企业用户而言,缓存命中率将成为决定实际使用成本的关键变量。

模型行业开始集体部署安全能力
紧跟Claude Fable 5.1和Claude Mythos 5.1之后,OpenAI将更多表达倾斜在网络安全问题上。
OpenAICEO山姆·奥尔特曼表示,整个夏天,团队都全力推进安全方面的工作。如今,能力和安全保障措施的同步提升比以往任何时候都更加重要。他同时承认,新模型Astra的训练工作已完成一段时间,但后续型号根据需要放慢了进度,以确保能够充分开展安全性和适配性方面的工作。
官方称,Astra已达到准备框架下的关键网络安全能力阈值,这意味着,在拥有合适的工具和访问权限的情况下,它可以发现此前未知的安全漏洞,并开发出在多个受保护系统中利用这些漏洞的方法,而无需人工指导每个步骤。这是OpenAI认定的首个达到此级别的模型,因此在开发过程中和发布前需要更严格的安全保障措施。
过去几周,OpenAI推迟了Astra的部分开发和发布工作,以便加强和测试其针对网络滥用和未经授权的模型操作的防护措施。虽然Astra并未卷入此前的Hugging Face事件,但OpenAI表示已将该事件的经验教训融入安全策略,并为Astra实施了更严格的安全措施,包括训练模型更可靠地拒绝有害网络请求、增加防止滥用的保护措施以及监控以阻止潜在的未经授权的活动。
Anthropic同样在加大安全建设投入。据官方披露,该公司正在对近期两起安全事件进行深入分析,并计划与METR合作进行独立审查,希望确保两项调查全面彻底,并将在未来几周内公布更多信息。
法国人工智能安全中心(CeSIA)执行主任查贝尔·拉斐尔表示,Anthropic刚刚宣布暂停高风险强化学习环境的开发,很可能是受近期模型安全事件影响而被迫采取的措施。在他看来,这与OpenAI于8月18日宣布暂停前沿强化学习训练的情况类似,而Anthropic更进一步,他们希望尽快建立一种合法、可验证的机制。
行业层面的集体行动也在同步推进。当地时间8月27日,OpenAI发布题为《呼吁开展网络防御的集体行动》的公开信,联合Anthropic、亚马逊云服务、谷歌、微软等百余家机构共同警告:随着全球各地模型能力不断提升,由人工智能发起的网络攻击将变得愈发广泛和复杂,留给各方强化网络防御的时间窗口有限。
公开信强调,医院、水处理厂、电网及互联网基础设施等关键公共服务正面临日益迫近的安全威胁。
安全议题的升温并未削弱厂商在能力赛道上的竞争态势。奥尔特曼在近期一场访谈中表示,团队一直想推进编程业务,但从优先级的角度来看,还是错过了这个机会。他同时强调,在任何一个阶段落后都不是灾难性的,可以通过更好的模型来迎头赶上。
从Anthropic以Fable 5.1刷新多项编程基准、OpenAI以Astra叩开“关键级”网络安全门槛,到谷歌暗中加码编程模型追赶,头部厂商之间的竞争仍在加速。而与此同时,模型行业正在尝试为这场竞速装上安全刹车。能力与安全的同步推进正成为下一阶段前沿模型竞争的核心命题。


