Anthropic于6月9日发布ClaudeFable5,属Mythos级模型,能力超越Opus。同一模型分Fable(公开版)与Mythos(受限版),Fable在网络安全、生物化学等高风险领域自动回退至Opus4.8。价格约为Opus的两倍,6月9日至22日免费。在代码迁移等复杂工程任务中表现突出,但日常任务性价比不高。
6月9日,Anthropic正式推出Claude Fable 5。这是其首次将「Mythos级」模型面向公众开放。根据官方定义,该等级的能力高于Opus系列。
简而言之,你现在可以通过Claude API和Claude Code使用一个性能超过Opus 4.8的模型,代价是更高的价格以及一项独特的安全设计。以下内容基于官方公告及相关报道,所有数据均已标注出处。
长期稳定更新的攒劲资源: >>>点此立即查看<<<
先理清命名逻辑。Anthropic此次同步发布了两个产品:Claude Fable 5和Claude Mythos 5。官方表示,两者基于同一底层模型,均属于「Mythos级」,该等级「高于我们的Opus系列」。
Mythos模型曾于今年4月以预览形式出现,但因网络安全顾虑,仅限少数合作伙伴使用。6月9日是其首次以公开可用的形态落地,公开版本即为Fable。
命名本身具有深意:Fable源自拉丁语fabula,意为「被讲述的内容」,与希腊语mythos同源。官方明确表示,Fable与Mythos的真正区别不在于模型本身,而在于安全机制。
这是本次发布中最值得关注的一点。
换句话说,Anthropic此次提供的并非两个不同的模型,而是同一模型搭配两套安全策略。能力上限相同,区别仅在于「哪些问题允许模型自由回答」。这种将安全机制作为产品分层的设计思路,值得工程领域从业者关注。
Fable的安全机制并非简单的「拒绝回答」,而是「切换模型来回答」。
官方列出了三个会触发回退的领域:网络安全、生物与化学、蒸馏。在这些话题上,官方原话是,回答会「转由我们次强的模型Claude Opus 4.8给出」。
这意味着,用户可能以为自己全程在使用Fable,但实际上部分回答来自Opus 4.8,且这一切换由模型自动完成。好在比例不高:官方表示安全机制「平均在不到5%的会话中触发」,「超过95%的Fable会话完全没有回退」。
对工程人员而言,这有两方面影响。一是省心,绝大多数情况下用户获得的是该等级的全部能力。二是需要心中有数:如果任务恰好涉及这三条线,收到的回答可能并非Fable的水准,而是Opus 4.8的,且用户未必能立即察觉。
安全方面,官方还提供了两个数据:外部赏金计划运行了1000多个小时,未发现通用越狱手段;对Mythos级的流量启用30天保留策略,数据不用于训练,所有人工访问均会留日志。
官方提供的能力证据主要来自合作方评测,以下如实转述,但需说明这些均由第三方测试得出。
软件工程方面:Stripe表示Fable 5将「几个月的工程压缩到几天」——一个5000万行Ruby代码库的迁移任务,人工需要两个月,而它一天完成。在Cognition的FrontierCode评测中,官方称Fable 5「在前沿模型中得分最高,即使只使用中等effort」。
知识工作方面:在Hebbia的金融基准测试中取得「所有模型中的最高分」;IMC表示它「几乎全面拿下了他们的交易分析评测」。
还有两个非典型例子。视觉:官方称其是视觉任务的最佳模型(SOTA),能「仅靠视觉」通关宝可梦火红版,无需地图或工具。长上下文与记忆:在玩《杀戮尖塔》时,带持久记忆带来的提升「是Opus 4.8的三倍」,达到游戏最终章的频率也是三倍。
如何看待这些数据?合作方评测天然偏向正面,但即便适当打折,方向是明确的:该等级在复杂工程任务上确实迈上新台阶。尤其是「中等effort就能获得高分」这一点,对需要权衡成本和效果的用户来说,是一个有意义的信号。
具体上手方式如下。
claude-fable-5。--model已将fable列为模型别名,即claude --model fable,或在会话中使用/model切换。价格:官方定价为每百万输入token 10美元、每百万输出token 50美元,据官方说法「不到Mythos预览版的一半」。根据CNBC、TechCrunch等报道,这一价格大约是Opus 4.8的两倍。
需根据场景决定,不建议无脑切换。
值得使用Fable的场景是那些「困难、有价值、且愿意为效果多付费」的任务,例如大规模重构、复杂迁移、长期未解决的架构问题。该等级「中等effort即可获得高分」的特性,意味着不一定需要拉满effort去烧钱,性价比反而可能不错。
不太值得的场景是日常的、Sonnet或Opus 4.8就能稳定完成的任务。Fable价格翻倍,在日常任务上多花的费用难以转化为对等的体验提升。此外,如前所述,如果任务涉及安全相关的三条线,需注意自己可能在不知情的情况下被切换至Opus 4.8。
还有一个实用的提醒:新模型刚发布,社区的实际使用反馈、踩坑经验以及与各家框架的适配尚未沉淀。如果模型用于生产流程,建议先在非关键任务上运行两天,观察在自己具体任务上的实际表现,再决定是否更换默认模型。官方评测归官方评测,自己的代码库才是真正的基准。
来源:Anthropic官方公告、TechCrunch、CNBC报道。模型能力数据为Anthropic及其合作方口径,本文如实转述并标注,不代表独立测评结论。
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述