Anthropic发布Claude Fable 5.1:科学推理能力大幅跃升,缓存成本降75%

Anthropic Claude Fable 5.1 Model Architecture Diagram

在人工智能竞争日益激烈的当下,Anthropic 再次通过技术创新引发了业界的广泛关注。近日,该公司正式推出了 Claude Fable 5.1 和 Claude Mythos 5.1 两款前沿模型。其中,Fable 5.1 已经面向公众开放,而 Mythos 5.1 则继续在受限环境中运行。这一更新不仅标志着 Anthropic 在模型性能上的突破,更在成本控制和上下文处理能力上实现了重大优化。

首先,最引人注目的莫过于 Claude Fable 5.1 在科学推理基准测试中的表现。根据官方公布的数据,Fable 5.1 在 Terminal-Bench-Science 0.1 测试中取得了 52.6% 的高分,相较于上一代版本 24.7% 的成绩,实现了近乎翻倍的提升。这一分数的跨越,意味着该模型在处理复杂的科学问题、逻辑推理以及学术研究相关任务时,具备了更强的准确性和鲁棒性。对于科研人员和企业开发者而言,这无疑是构建高精度智能系统的强有力工具。

其次,为了解决长文本处理中的“痛点”,Anthropic 将 Claude Fable 5.1 的上下文窗口扩展到了惊人的 100 万个 Token。这一巨大的容量允许模型一次性处理超长篇幅的文档、代码库或复杂的会议记录,极大地提升了多轮对话和长文档分析的工作效率。同时,为了降低长上下文场景下的使用成本,Anthropic 对缓存机制进行了优化。新的缓存读取价格降至每百万 Token 0.25 美元,相比之前降低了 75%。这一价格策略极具吸引力,它使得企业用户在进行大规模数据处理时,无需担心高昂的 token 成本,从而加速了 RAG(检索增强生成)等应用在实际业务中的落地。

在 API 接口层面,Anthropic 此次也带来了一些破坏性的更新。其中最关键的变化是移除了“强制工具使用”功能。这一改动赋予了开发者更大的控制权,允许他们更灵活地定义模型的工具调用行为,这对于构建复杂的自主智能体和自动化工作流具有重要意义。开发者不再受限于固定的工具调用逻辑,可以根据实际业务需求自由编排模型的行动。

值得注意的是,与 Fable 5.1 并行的 Claude Mythos 5.1 则主要服务于 Anthropic 的安全研究项目 Glasswing。作为更侧重于安全防护层的模型,Mythos 5.1 的公开受限性质,体现了 Anthropic 在追求性能的同时,对 AI 安全和可控性的持续重视。

总体来看,Claude Fable 5.1 的发布展示了 Anthropic 在通用人工智能能力上的快速迭代。通过提升科学推理能力、扩大上下文窗口以及大幅降低缓存成本,Anthropic 正在为开发者提供一套既强大又经济的 AI 解决方案。随着 API 变更的生效,开发者需要及时调整代码以适配新的接口,这无疑将推动新一轮的 AI 应用创新。

信息来源:MarkTechPost,原文链接:https://www.marktechpost.com/2026/09/01/anthropic-releases-claude-fable-5-1-and-claude-mythos-5-1-52-6-on-terminal-bench-science-and-75-cheaper-cache-reads/

封面图片来源:Unsplash / 摄影师 Brecht Corbeel

oaido_ai

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注