Anthropic News 中文翻译

create: 2026-06-09
update: 2026-08-10
author: thinkycx
title: 【译】Claude Fable 5 和 Claude Mythos 5 发布
description: Anthropic 发布 Claude Fable 5(面向通用的 Mythos 级模型)和 Claude Mythos 5(解除部分安全护栏的版本)。Fable 5 在几乎所有测试基准上达到最先进水平,尤其在软件工程、科学研究和药物设计方面表现突出。定价 $10/$50 每百万 token。
category: translation
tags: anthropic, news, translation, fable-5, mythos-5

Claude Fable 5 和 Claude Mythos 5 发布

原文发布于 2026 年 6 月 9 日

Claude Fable 5 和 Mythos 5

状态更新


概述

Claude Fable 5 是一个面向通用的 Mythos 级模型,在几乎所有基准上达到最先进水平,任务越长越复杂优势越大。 Fable 5 超越了此前所有通用模型的能力,在软件工程、知识工作、视觉、科学研究等领域表现卓越。

模型 定位 特点
Claude Fable 5 Mythos 级模型 + 安全护栏 敏感查询回退到 Opus 4.8
Claude Mythos 5 同一底层模型,解除部分护栏 通过 Project Glasswing 部署给网络安全防御者

定价: $10 / 百万输入 token,$50 / 百万输出 token(不到 Mythos Preview 价格的一半)

护栏触发率: 平均不到 5% 的会话会触发


基准测试

Fable 5 / Mythos 5 基准对比


软件工程

Fable 5 在软件工程任务上表现极为突出,能将数月的工程工作压缩到数天。

  • Stripe 案例: 在 5000 万行 Ruby 代码库中,Fable 5 在一天内完成了原本需要团队两个多月的迁移任务
  • FrontierCode 评测(Cognition): 在 medium effort 下即获得前沿模型最高分

FrontierCode 评测

SWE 评测


知识工作

  • Hebbia 金融基准测试中得分最高,在文档推理、图表解读和问题解决方面均有提升
  • IMC 评价:"在交易分析评测中几乎全面通过"

视觉能力

  • 视觉任务达到最先进水平
  • 能从科学图表中提取精确数字
  • 仅凭截图重建 Web 应用源代码
  • 用极简纯视觉框架(vision-only harness)通关 Pokemon FireRed(此前模型需要复杂辅助框架)

记忆与长上下文

Fable 5 在数百万 token 的上下文中保持专注。Slay the Spire 游戏中,基于文件的持久记忆使性能提升比 Opus 4.8 高 3 倍;Fable 到达最终章节的频率是其他模型的 3 倍。


药物设计

蛋白质设计

Mythos 5 将药物设计加速约 10 倍。

  • 内部蛋白质设计专家使用 Mythos 5 实现了约 10 倍的效率提升
  • "匹配或超过熟练人类操作员"使用蛋白质设计工具的水平,且无需人工协助
  • 14 个蛋白质靶点中有 9 个产出了强候选物

分子生物学新假说

Mythos 5 是第一个能"持续产出新颖且有说服力的科学假说"的模型。

  • 盲测中科学家约 80% 的时间更偏好 Mythos 的假说(对比 Opus 级模型)
  • 一个关于大肠杆菌蛋白质机制的假说已被独立实验室的研究所证实

基因组学研究

在大约一周的基本自主工作中,Mythos 5 完成了:

  1. 整合 138 个动物物种、数百万个细胞的单细胞数据
  2. 设计并训练了一个自定义 ML 模型
  3. 该模型超越了最近发表在 Science 上的模型,尽管体积小 100 倍

对齐评估

对齐评估

错误行为率低,与 Opus 4.8 相当。详见 System Card


早期用户反馈

用户 公司/角色 评价
Michael Truell Cursor CEO CursorBench 最先进,打开了"此前不可能的长期任务"
Mario Rodriguez GitHub CPO 复杂长期编码任务超越此前基准
Matt Colyer Replit 产品总监 Agent 编码和原型设计中"任何 Claude 模型的最强结果"
Sean Ward FutureHouse CEO 达到"高级研究科学家级别"
Fabian Hedin Lovable CTO "一年前需要 100 个 prompt 的应用,现在一次搞定"
Scott Wu Cognition CEO FrontierBench 最高分,长期推理卓越
Izzy Miller Hex AI 研究负责人 "第一个在核心分析基准上突破 90% 的模型"
Peter Wang Camelot CSO "在每个 effort 级别上都超越 Opus 4.8",完成速度快 25-30%

安全护栏

1. 网络安全

网络安全评测

Jailbreak 抵御

  • constitutional classifiers 阻止 Fable 在攻击性网络任务上取得进展(漏洞利用、侦察、横向移动)
  • 外部赏金计划(1000+ 小时)未产出通用 jailbreak
  • 英国 AISI "在短期初始测试窗口内取得了一定进展"
  • 外部合作伙伴测试:Fable 5 对网络攻击规划、漏洞利用开发或防御规避的有害单轮请求"零配合"——即使使用了 30 种不同的公开 jailbreak 技术

2. 生物与化学

Fable 5 和 Mythos 5 适用 ASL-3 安全级别。

  • 范围比此前的生物武器分类器更广
  • AAV(腺相关病毒)评测:Mythos 级模型超越了专用蛋白质语言模型
  • 目前大多数生物/化学请求回退到 Opus 4.8
  • 计划推出研究者可信访问计划

3. 蒸馏防护

  • 防止大规模能力提取用于训练竞争模型(特别是威权国家)
  • 被标记的请求回退到 Opus 4.8

数据保留政策

  • 所有 Mythos 级模型流量(第一方和第三方)实施 30 天保留
  • 不用于训练(详见商业条款
  • 新隐私保护:记录人工访问,几乎所有情况下 30 天后删除

Mythos 5 与可信访问计划

  • 当前 Mythos Preview 用户(如 Glasswing 合作伙伴)可升级到 Mythos 5(网络安全护栏解除)
  • 生物学可信访问计划:Fable 5 解除生物/化学护栏(网络安全护栏保留),初期规模小

可用性

模型 API 名称 访问范围
Fable 5 claude-fable-5 全平台可用
Mythos 5 - 仅 Glasswing 合作伙伴及部分生物研究者

详见模型概览

订阅计划时间线:

时间 状态
6/9 - 6/22 Pro/Max/Team/Enterprise 计划免费包含
6/23 起 从上述计划中移除,需使用量积分
未来 计划在容量允许时恢复为标准订阅内容

备注

  1. Mythos 级模型在能力上高于 Opus 级。第一个是 Claude Mythos Preview(4 月),其后是 Fable 5 和 Mythos 5。
  2. "Fable"源自拉丁语 fabula("被讲述的故事"),类似于希腊语 mythos。安全护栏是两个模型名称的区别所在。
  3. 通用 jailbreak 定义:任何允许像护栏不存在一样交互的 prompt/脚本/框架;与仅在有限上下文中有效的"小型 jailbreak"相对。