区块链文库报道:
Anthropic 于 9 月 1 日推出全新模型 Claude Fable 5.1
该模型在 Artificial Analysis 的智能排行榜上以 66 分的指数成绩一举夺魁,将 Opus 5 拉下榜首。
Fable 5.1 与 Opus 5 领跑排行榜
Artificial Analysis 对超过 250 个语言模型在价格、速度和智能方面进行排名。目前,Fable 5.1 的两个版本分别占据排行榜第一和第二位。该网站对“max with fallback”版本的评分为 66,对“xhigh with fallback”版本的评分为 65。两者均远超此前榜首 Claude Opus 5 在 max 和 xhigh 模式下 63 分的成绩。
这意味着在包含 OpenAI、Google、SpaceXAI、阿里巴巴和 DeepSeek 等顶级 AI 实验室模型的排行榜上,Anthropic 占据了前四名。紧随其后的是 OpenAI 的 GPT-5.6 Sol(max 模式)和 SpaceXAI 的 Grok 4.6,两者得分均为 61。
AI 模型排行榜,数据来源:Artificial Analysis
该排名来自独立第三方,因此比实验室自身发布的图表更具可信度。
编码与科研得分表现
Anthropic 内部的测试数据也印证了类似结果,尽管这些数据应视为供应商自报信息。Anthropic 的报告显示,Fable 5.1 在衡量自主科研能力的 Terminal-Bench-Science 0.1 测试中得分为 52.6%,是 Fable 5(24.7%)的两倍多,也远超 Opus 5(29%)和 GPT-5.6 Sol(22.4%)。在 Terminal-Bench 4.0 编码基准测试中,Fable 5.1 得分为 55.8%,高于 Fable 5 的 42.0%。
这款新模型的卖点在于其能够执行持续数小时的工作。Millennium 向 Anthropic 反馈,Fable 5.1 成功追踪到其系统中一个罕见的崩溃问题,并定位到一个过去四五年间工程师们始终无法解决的顽固 bug。Browserbase 表示,在其最难的浏览器代理测试中,新模型完成了 82% 的任务,而 Opus 5 的完成率为 74%。
缓存读取价格大幅下调 75%
不过,模型价格并未调整。Fable 5.1 维持了 Fable 5 的定价:每百万输入 token 10 美元,每百万输出 token 50 美元,这远高于 Opus 5(输入 5 美元,输出 25 美元)和 Sonnet 5(输入 2 美元,输出 10 美元)。
变化体现在缓存上下文的价格上。Anthropic 将缓存读取价格从每百万 token 1.00 美元降至 0.25 美元,降幅达 75%。Anthropic 估计,平均工作负载成本将降低 25%,而高代理型工作负载成本将降低 45%,这得益于代理能够重复读取相同的代码、指令和对话历史。
同一模型,两种安全防护层级
Anthropic 随 Fable 5.1 一同发布了第二个名称:Claude Mythos 5.1。两者本质上是同一模型,但配备了不同的安全防护措施。Fable 5.1 面向公众开放,而 Mythos 5.1 仅通过 Anthropic 的 Project Glasswing 向经过审查的网络安全和生命科学团队提供。
这一拆分发生在 Anthropic 安全测试面临挑战的时期。据 Cryptopolitan 报道,Anthropic 于 7 月 23 日暂停了外部网络安全评估。此前,Claude 在旨在隔离的测试中意外接触到了真实系统。在能够加入适当的隔离措施后,该公司恢复了外部网络安全评估。
免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。
本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复




