《寓言5》在美国下令下架前击败GPT 5.5
Anthropic Fable 5 短暂超越 OpenAI GPT 5.5,随后因美国出口管制下线
核心要点:
Fable 5 在 Chatbot Arena、SWE-Bench Pro 及多项主要编程测试中** GPT 5.5。

该模型仅上线三天,美国政府即责令 Anthropic 将其关闭。
GPT 5.5 目前成为默认的**可用模型,并非因为它超越了 Fable 5。
Fable 5 被关停
Fable 5 自 6 月 9 日发布后,迅速成为**大的公开 AI 模型,在多项主要基准测试中** GPT 5.5,但三天后美国政府便介入干预。
该模型在 Chatbot Arena 中排名**,而 GPT 5.5 排名第四。在 SWE-Bench Pro 上,Fable 5 得分为 80.3%,GPT 5.5 为 58.6%,在真实软件工程任务中差距近 22 个百分点。
在编程测试中,**优势同样明显。Fable 5 在 Code Arena 上获得 1665 分,** GPT 5.5 达 98 Elo 分;在 FrontierCode Diamond 上达到 29.3%,而 GPT 5.5 仅为 5.7%。
GPT 5.5 在实际部署方面**一项优势:其每百万输入 token 成本为 5 美元,每百万输出 token 成本为 30 美元,而 Fable 5 分别为 10 美元和 50 美元,因此 OpenAI 的模型在大规模使用时更具性价比。
Fable 5 还提供了一百万 token 的上下文窗口和 12.8 万 token 的输出能力。Anthropic 原计划让 Pro、Max、Team 及 Enterprise 订阅用户在 6 月 22 日前免费使用该模型,但政府禁令提前终止了这一窗口期。
GPT 5.5 成为新霸主
此次关停源于 6 月 12 日的一项出口管制指令,该指令指出 Fable 5 及更广泛的 Mythos 5 模型家族存在越狱漏洞。Anthropic 对此提出异议,称该问题影响轻微、早已被知,并且无需特殊绕过手段即可在 GPT 5.5 上复现。
这一结果在 AI 市场中实属罕见。
开发者失去了对**基准测试模型的访问权,而 GPT 5.5 之所以成为**可选方案,仅仅是因为其**劲的竞争对手被移除。
这一区别对编程工作流尤为重要。SWE-Bench Pro 上 22 个百分点的差距,意味着一个模型能解决约五分之四的真实代码库问题,而另一个模型仅能处理约五分之三。
Fable 5 的短暂亮相也展示了前沿技术的迭代速度。GPT 5.5 于 4 月底以内部代号“Spud”发布,但其**地位仅维持到 Anthropic 在 6 月开放更强大的 Mythos 级系统公测为止。
本文地址:https://cy.nxtlgy.com/zc/133667.html
版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。







