Anthropic推出Claude Fable 5与Mythos 5双轨版本
Anthropic在同一天发布两个不同定位的Claude 5系列模型
Anthropic于六月十日同时对外发布Claude 5系列的Fable 5与Mythos 5两个版本,分别面向普通用户和高强度推理场景。Fable 5采用多架构统一训练路径,在多项基准测试中取得显著改进,MMLU-Pro得分达到百分之八十九点三,GPQA钻石集正确率百分之七十六点一。Mythos 5则强化链式推理能力,在AIME 2026数学竞赛题目上达到百分之八十四点二的解题正确率,较前代提升近十二个百分点。两个版本共享同一底层训练框架,区别在于推理阶段的温度参数和上下文窗口配置。Fable 5默认上下文窗口为一百二十八万词元,Mythos 5提供两百万词元的可选扩展选项。
Anthropic在技术报告中详细列出了两个版本的训练数据构成。Fable 5使用约十四万五千亿词元的混合语料进行训练,其中高质量标注数据占比从上一代的百分之十二提升至百分之十八。Mythos 5则采用分阶段训练策略,第一阶段用三十万亿词元进行通用语言建模,第二阶段针对数学推理、代码生成和科学问答三个方向进行加权精调,每个方向投入约两万亿高质量专用数据。训练过程消耗约九万六千个H100 GPU运行时间,Anthropic称其能源消耗较Claude 4时期下降百分之二十七,主要得益于注意力机制的优化和稀疏激活技术。
在编码能力方面,两个版本均通过HumanEval与MBPP双重测试。Fable 5在HumanEval上达到百分之九十六点五的通过率,Mythos 5达到百分之九十八点二。对于更复杂的SWE-Bench Verified任务,Mythos 5解决真实GitHub仓库问题的成功率达到百分之七十三点四,较Claude 4 Opus版本提升近十五个百分点。Anthropic开放了两者的API接口,Fable 5输入价格为每百万输入token零点三美元、输出价格零点七五美元,Mythos 5输入价格零点六美元、输出价格一点五美元。Anthropic同时表示将继续发布中等算力版本的Claude 5系列,预计第三季度上线。
Anthropic首席执行官Dario Amodei在博客中写到,双轨策略不是产品定位的分流,而是为了满足不同类型用户的工作负载需求。Fable 5适合日常对话、文档分析和创意写作,Mythos 5则针对科研人员、软件工程师和数学竞赛选手。两个版本均支持多模态输入,包括文本、图片和PDF文档。Anthropic的监管沙盒工具同时更新了与两个版本的对齐测试套件,声称对模型输出进行了更严格的边界测试。
从行业发展的角度看,人工智能安全已经成为全球科技治理的核心议题之一。各国政府和国际组织正在加速制定相关法规和标准,以确保人工智能技术的发展不会对人类安全构成威胁。在这一背景下,人工智能安全分级可能成为未来人工智能产品进入市场的必要条件。投资者对人工智能安全领域的关注度也在不断提升,二零二五年全球人工智能安全领域的投资额超过五十亿美元,同比增长超过百分之八十。