Anthropic正式发布Claude Fable 5.1与Claude Mythos 5.1,Anthropic将两款模型称为全球最先进的编程和知识工作模型。两款模型底层能力相同,主要面向编程、知识工作、Agent及科研场景。
Fable 5.1面向大众和企业开放,Mythos 5.1则通过可信访问计划提供,重点服务网络安全和生命科学领域。
Fable 5.1在多项代理式编码和科研任务中较前代明显提升。Anthropic称,新模型更擅长长时间、多步骤任务,可持续调用工具并定位问题的根本原因。Jane Street、Cognition和Millennium等早期用户也表示,其在复杂编码、交易相关推理和故障排查场景的表现较前代有所改善。
在科研方面,Anthropic称,Mythos 5.1利用开源工具设计出的部分分子结合物,其亲和力较此前相关竞赛中的最佳结果提升约一个数量级,在12个测试靶点上的有效命中率接近50%;Fable 5.1则利用NASA“麦哲伦”号探测器三十多年前获取的雷达数据,为约三分之一的金星表面生成了新的高分辨率高程图,将部分地形细节的分辨能力从此前约10至20公里提高至2至3公里。Mythos 5.1还通过编写定制GPU内核,对多个开源生物学深度学习模型进行优化,最高实现约2.5倍推理加速,部分大规模分析任务的预计GPU成本可降低30%至60%。
在价格方面,Fable 5.1输入、输出价格仍为每百万token 10美元和50美元,但缓存读取价格降至0.25美元,典型工作负载成本预计降低约25%,复杂Agent任务最高可降约45%。Anthropic还推出企业级EFS安全机制,并称Claude Code的安全误拦截可减少约60%。
目前Fable 5.1已通过Anthropic平台以及AWS、Google Cloud和Microsoft Azure提供服务。Mythos 5.1仅供部分美国机构使用,但Anthropic正在与美国政府协调,尽快将访问权限扩展到更广泛的国内外合作伙伴。Anthropic表示,如需通过CVP申请参与用于网络防御的Claude Mythos 5.1,可在此处申请。
via 匿名
Opus 5 现已在所有付费计划和 Claude API 上线,定价与 Opus 4.8 相同。
它是 Claude Max 的默认模型,也是 Claude Pro 里表现最强的选择。
同时,Opus 5 还提供“快速模式”,运行速度约为默认速度的 2.5 倍。
在多项代码与知识工作评估中,Opus 5 已达到新的前沿水平;
Opus 5 同样效率极高:在每个任务的成本相当甚至更低的情况下,它的表现优于其他模型;
在 ARC-AGI-3 的一项评测中,要求 AI 模型应对全新问题;Opus 5 的成绩是紧随其后的最佳模型的三倍。
相较于其他型号,它的鲁莽或欺骗行为发生率最低,同时对 Claude 宪章的遵循也最为充分。
在网络安全任务上,Opus 5 的表现比 Opus 4.8 更强;但在开发漏洞利用方面,它依然明显不及 Mythos 5。其安全防护旨在帮助开发者发现并修复软件漏洞,并同时拦截高风险的使用场景。
Anthropic 表示,Fable 5 将于 7 月 1 日起,在 Claude Platform、Claude ai、Claude Code 和 Claude Cowork 上向全球用户开放。
对于 Pro、Max、Team 和部分企业版套餐用户,Fable 5 将在 7 月 7 日之前最多可以用到每周使用额度的50%(for up to 50% of weekly usage limits through July 7),之后将通过 usage credits 提供。我们将尽快恢复在 AWS、Google Cloud 和 Microsoft Foundry 上的访问权限。
6 月 12 日的出口管制指令源于政府获悉一份报告,该报告称亚马逊的研究人员发现了一种绕过 Fable 5 安全防护的方法:
通过提示它识别出多个软件漏洞。在其中一个案例中,该模型生成了展示如何利用相关漏洞的代码。过去两周,Anthropic 一直与政府及其他合作伙伴(包括亚马逊)密切合作,以审查该报告和相关证据。
Anthropic 测试证实,包括 Claude Opus 4.8、GPT-5.5 和 Kimi K2.7 在内的许多能力较弱的模型,都能够识别出与报告中 Fable 5 所发现的相同漏洞。
Anthropic 表示,他们与政府合作训练了一个改进的安全分类器,该分类器能够识别并拦截亚马逊报告中描述的行为。
如果对 Fable 5 的请求被拦截,用户将会收到通知,并且该请求将被转而发送到 Opus 4.8。新的分类器意味着亚马逊报告中描述的特定技术在超过 99% 的情况下都会被拦截。
在极少数情况下,模型可能会提供信息,但其详细程度不足以帮助网络攻击者。模型的安全措施预计不会拦截所有低风险的常规网络防御功能,而只会拦截那些可能造成危害的功能。
via 匿名
为防止在网络安全等领域被滥用,针对特定范围内的主题将由Opus 4.8响应
Fable 5 在几乎所有已测试的基准上都达到了最先进水平,且在软件工程、知识工作、科学研究以及视觉任务中表现尤为突出。
任务越冗长、越复杂,Fable 5 相对我们其他模型的优势就越明显。
为防止滥用,当 Fable 的分类器识别到请求与网络安全、生物学和化学,或与蒸馏相关时,系统会自动将该请求交由 Claude Opus 4.8 来生成回复。
• Fable 5与Mythos 5价格相同,每百万输入令牌 10 美元,每百万输出令牌 50 美元。开发者可以通过 Claude API 使用 claude-fable-5。
• 从今天起到 6 月 22 日,Fable 5 将免费包含在 Pro、Max、Team 以及按席位计费的企业版计划中,无需额外付费。
• 6 月 23 日起,我们会将 Fable 5 从这些计划中移除。之后如需使用,将需要消耗使用额度(usage credits);如果容量允许,我们也会相应延长订阅所包含的使用期限。
• 在此之后——当容量充足时,我们计划把 Fable 5 重新作为订阅计划中的标准选项提供。我们希望尽快实现这一目标。