Claude Fable 5 深夜炸场!Anthropic 解封“神话”级模型,编程屠榜、安全降级,AI 进入能力封装时代

Ai资讯2个月前发布 大国Ai
633 0 0

摘要: Anthropic 于今日凌晨突然发布 Claude Fable 5Mythos 5,标志着 AI 大模型正式迈入 Mythos(神话)级时代。Fable 5 在编程、视觉与科研领域全方位碾压 GPT-5.5 等竞品,甚至在 5000 万行代码库迁移中展现出了“一人顶一团队”的恐怖工程力。然而,与极致能力相伴的是极致的安全枷锁——Anthropic 为其装上了“策略路由器”,遇敏感问题自动降级至 Opus 4.8,这种“戴着镣铐跳舞”的能力封装模式,或许将是未来 AI 商业化的新常态。

深夜无预警,Anthropic 投下了一枚核弹。

如果说之前大家对 AI 的印象还停留在“聪明的代码助手”,那么今晚发布的 Claude Fable 5 则彻底坐实了“赛博包工头”的名号。这不仅仅是一次简单的模型迭代,更是 Anthropic 在 IPO 前夜向全世界展示的肌肉:我有能力造神,也有能力给神戴上镣铐。

同一个大脑,两张面孔:Fable 与 Mythos 的双生局

这次发布的重头戏,其实是关于“如何安全地释放洪荒之力”。

Claude 家族现在有了新的等级划分:Haiku、Sonnet、Opus,以及全新的旗舰 Mythos(神话)级。Fable 5 和 Mythos 5 本质上是同一个底层模型,区别全在“安全护栏”上。

Mythos 5 是那个被关在笼子里的野兽。早在今年 4 月,Anthropic 就通过 Project Glasswing 项目将其提供给少数网络安全防御者,因为它太擅长找漏洞了,甚至能发现主流操作系统和浏览器中长期未被发现的高危漏洞。放在防守者手里是神兵利器,放在攻击者手里就是自动化漏洞挖掘机。

Claude Fable 5 深夜炸场!Anthropic 解封“神话”级模型,编程屠榜、安全降级,AI 进入能力封装时代

Fable 5,则是给这只野兽套上了电子项圈后的公众版。Fable 源自拉丁语 fabula(被讲述的故事),与 Mythos 同源,寓意虽强,但已被“驯化”。

编程屠榜:从“辅助编码”到“独立施工”

别看 Fable 5 带着枷锁,在通用领域它的表现依然是断层式第一。

最直观的体现是跑分:在 SWE-Bench Pro 上,Fable 5 拿下了 80.3%,而 GPT-5.5 只有 58.6%;在更接近真实工程环境的 FrontierCode Diamond 评测中,Fable 5 得分 29.3%,Opus 4.8 只有 13.4%,GPT-5.5 更是仅有 5.7%。这不是简单的百分比领先,这是维度的压制。

更可怕的是实战表现。支付巨头 Stripe 用 Fable 5 在一个包含 5000 万行 Ruby 代码的庞大代码库中做迁移,结果这个原本需要一个团队两个月才能干完的活,Fable 5 一天就搞定了。前 OpenAI 联合创始人 Karpathy 体验后感叹:“当你给它一个真正困难的任务时,模型像是真的‘懂了’,然后闷头就去执行,那种想让人彻底不看代码、放手让它干的感觉,以前从来没有这么强烈过。”

此外,在终端操作测试 Terminal-Bench 2.1 中,Fable 5 以 88.0% 的成绩压过了 OpenAI Codex CLI 组合的 83.4%。这意味着 AI 编程已经从“帮你写函数”进化到了“帮你接管工程流程”。

视觉与科研:不仅能看图写码,还能提出科学假说

Fable 5 的视觉能力也迎来了质变。它不再是简单地描述图片,而是能“看懂”并“执行”。

它能从复杂的科学图表里抠出精确数值,甚至仅凭一张截图就能还原出整个网页应用的源代码。为了展示这种能力,Anthropic 让它玩《宝可梦·火红》,之前的 Claude 即便配上复杂辅助工具都玩不转,而 Fable 5 仅靠看原始截图就一路通关了。

而在科研领域,解除了生化限制的 Mythos 5 更是展现了“科学家”的潜质。它不仅是 Anthropic 首个能稳定提出新颖科学假说的模型,在盲测中约 80% 的情况下科学家更偏好它的分子生物学假说。甚至它提出的一个关于大肠杆菌蛋白新机制的假说,已经被独立实验室证实。在基因组学上,Mythos 5 自主工作一周,训练出的机器学习模型超越了《Science》期刊上的最新模型,体积还小了 100 倍。

安全机制:AI 版本的“金蝉脱壳”

这是 Fable 5 最具革命性的一点,也是 Anthropic 最得意的工程杰作。

与其说 Fable 5 是一个大模型,不如说它是一个被安全防火墙重重包裹的工程化产品包。Anthropic 没有选择简单的“拒答”,而是搞了一套 Capability Fallback(能力降级系统)

当你提问涉及网络安全、生物化学合成、模型蒸馏三大禁区时,系统不会报错,而是会在后台悄无声息地把你的请求路由给上一代模型 Opus 4.8 来回答。也就是说,你以为你在和最强神话对话,其实碰到红线时,出来接客的已经是前任了。

官方称只有不到 5% 的会话会触发降级。但据早期测试者反馈,这 5% 是按会话数算的,如果你是搞安全研究或生信分析的开发者,体感触发率远高于此,甚至连记忆里含有生物信息都有可能被拒,需要开启隐身模式才能正常打招呼。为了配合这套机制,Anthropic 还强制保留了 Mythos 级模型所有流量 30 天的数据用于安全审计,且承诺不用于训练。

价格与上市:曲速引擎不去超市

强悍的能力伴随着高昂的代价。Fable 5 定价为 10 美元/百万输入 Token,50 美元/百万输出 Token,价格是 Opus 4.8 的两倍,比 GPT-5.5 输入贵一倍,输出贵 2/3。

虽然这比之前 Mythos Preview 不到一半的价格已经很良心了,但考虑到长任务动辄消耗数十上百万 Token,账单依然会很美丽。正如一位开发者所言:“曲速引擎能飞跨银河系,但你不会开着它去超市。

目前,Fable 5 已在 API 端全面开放,订阅用户在 6 月 22 日前可免费使用(按双倍 Opus 额度扣减),之后将被移出订阅包,需消耗 Usage Credits 按量付费。

写在最后:能力封装时代的序幕

Anthropic 此次发布,不仅仅是在秀技术肌肉,更是在向资本市场(尤其是在其秘密提交 IPO 申请的背景下)证明一件事:我能造出最强的怪物,也能把它装进笼子里卖钱。

Fable 5 证明了当模型能力强到一定程度,如何给它套上合适的“笼子”,让其既能安全合规地商业化,又不触碰监管红线,已经变成了和提升智商同等重要的核心技术活。大模型竞争,已经从单纯的“参数军备竞赛”,进入了比拼“能力封装与路由”的工程化时代。


文章来源:

  • [1] 机器之心Pro:刚刚,Claude最强模型Fable 5发布:性能爆炸,价格翻倍
  • [2] 腾讯新闻:“神话级”AI走向大众,但Anthropic给它装了个安全阀门
  • [3] 网易订阅:Claude深夜炸场!放出史上最强“危险级”模型Fable 5,价格逆天
  • [4] 网易订阅:Claude 新模型 Fable 5 全解析:Mythos 级别的怪物
  • [5] ZAKER新闻:Claude深夜炸场!史上最强“危险级”模型发布,但价格更逆天
  • [6] 腾讯新闻:如何看待 Anthropic 发布 Claude Fable 5?大模型正式进入“能力封装”时代
  • [7] 华尔街见闻:IPO前“秀肌肉”:Anthropic推出最强公开模型Fable 5,戴安全枷锁解锁Mythos级能力
  • [8] IT之家:最强 Claude 模型:Anthropic 推出 Fable 5/Mythos 5,书写 AI 神话
  • [10] Chinaz:AI界巨震!Anthropic发布第五代Claude:Fable5狂揽编程榜首,Mythos5跨界攻克科学绝密
© 版权声明

相关文章

暂无评论

none
暂无评论...