摘要: Anthropic毫无预警丢出“王炸”Claude Fable 5,携Mythos级底层能力横扫各大AI基准测试,在编码、视觉、科研全面碾压GPT-5.5与自家前代Opus 4.8。然而,这头性能怪兽却被套上了史上最严苛的“安全护栏”,不仅长任务极易触发降级,甚至让生物学家连说句“Hi”都被拒之门外。一文带你看透Fable 5的恐怖实力与它的“尴尬护栏”。
今天凌晨,当大多数人还在熟睡时,Anthropic不声不响地把AI圈的桌子掀了——Claude Fable 5正式发布。如果你关注过大模型圈的风声,肯定对“Mythos”这个名字不陌生。没错,就是那个今年4月被Anthropic自己标红为“危险级”、只敢给少数安全机构用的神话级模型。
现在,Anthropic终于给它套上了护栏,放了出来。套上护栏的叫Fable 5(寓言),没限制的叫Mythos 5(神话),两者同根同源,只是一个是“戴着镣铐跳舞”,另一个是“全员恶人”。Anthropic自己也坦言:“发布如此强大的模型伴随着风险,如果没有安全措施,Fable 5在网络安全等领域的强大功能可能会被滥用,造成严重损害。”
废话不多说,咱们先看账面数据。Fable 5几乎在所有维度的跑分上都展现出了“不留活路”的统治力。
1. 代码与工程:从“辅助写函数”到“接管工程流程” 在真实软件工程评测FrontierCode Diamond上,Fable 5拿下29.3%,而Opus 4.8只有13.4%,GPT-5.5更是仅有5.7%。这不是简单的百分比领先,而是代差。在SWE-Bench Pro上,Fable 5达到80.3%,同样把GPT 5.5的58.6%和Gemini 3.1 Pro的54.2%远远甩在身后。
最夸张的实战案例来自Stripe:在一个拥有5000万行代码的Ruby代码库中,Fable 5仅用一天就完成了整个代码库的迁移,如果人工团队来做,这得干两个多月。甚至连Karpathy都感叹这是一个“非常令人兴奋”的版本,提升幅度堪比去年底的Claude 4.5。
2. 视觉与空间:纯视觉通关宝可梦 Fable 5目前已经是最先进的视觉任务模型。以前的Claude玩《宝可梦:火红》,得挂一堆复杂的辅助设备喂状态;现在的Fable 5,仅凭看原始截图,硬生生从新手村打到了通关。除此之外,它还能从科学图表里抠出精确数字,甚至看几眼截图就能把Web应用的源码给你重建出来。
3. 科研与生物:假设被实验室证实 这是Mythos 5最令人头皮发麻的地方。Anthropic内部的蛋白质设计专家用Mythos 5,把药物设计流程部分环节的效率提升了约10倍。更离谱的是,它提出了一个关于大肠杆菌蛋白质新机制的假说,竟然在另一个独立实验室的研究中得到了证实。在基因组学上,它甚至自主设计训练了一个机器学习模型,超过了近期发表在《Science》上的同类模型,体积还小了100倍。
如果说Fable 5的性能是“斗宗强者”,那它的安全护栏多少有点“斗气化马”了。
Anthropic给它加了一组安全分类器,一旦触碰网络安全、生物化学、蒸馏三条红线,对话就会被强制降级到Opus 4.8。官方说触发率不到5%,但实际体验简直是另一种画风。
比如,一位生物学家对着Fable 5说了句“Hi”,直接被拒。原因竟是系统记忆里有他的职业信息,判定为生物风险……开启隐身模式才能正常打招呼。不少早期用户抱怨,根本跑不通一个“全程由Fable回答”的长任务,稍微复杂一点的工作,半路就跳出一个“Switched to Opus 4.8”,让你体会深深的“不配得感”。
Anthropic的初衷很好理解:Mythos级别的模型在漏洞挖掘上太恐怖。在ExploitBench评测中,Fable 5的Cap%达到了78.0%,而Opus 4.8只有40.0%,GPT-5.5为34.0%。这要是落到黑客手里,就是自动化漏洞挖掘机。所以Anthropic干脆一刀切:生物化学和网络安全相关的请求,宁可错杀绝不放过。甚至,Anthropic还明确限制了“不能用Fable 5去开发新的大模型”[ ^2],这护城河挖得也是够深。
此外,还有一条容易被忽视的规矩:Mythos级模型的所有流量,无论是自家界面还是第三方,都强制要求30天数据保留,记录所有访问,30天后删除,但绝不用于训练。
Fable 5的定价相当硬核:每百万输入token 10美元,每百万输出token 50美元。这比Opus 4.8贵了一倍,比GPT-5.5输入贵一倍、输出贵2/3。而没拔护栏的正版Mythos 5,定价更是高达$25/$125。
不过,Anthropic还是给了一点甜头:从即日起至6月22日,Pro、Max、Team以及按席位计费的企业版用户,都能免费使用Fable 5(但消耗同等用量Opus两倍的额度)。6月23日起,它将从订阅方案中移除,想要继续用就得花usage credits了。API端目前可以直接调用claude-fable-5。
claude-fable-5
至于那个无限制版的Mythos 5?想都别想,依然只给Project Glasswing的合作机构用,后续会逐步开放给特定的网络安全防御机构和生物研究者。
Fable 5的出现,再次证明了大模型的能力天花板还在被暴力拉升。无论是处理五千万行代码库的工程魄力,还是自主提出科学假说的惊悚智力,Anthropic这次确实验证了“神话级”的含金量。
但与之伴生的,是愈发收紧的安全枷锁。性能越强,恐惧越深。当你试图用一个全能的AI助手去推进复杂任务时,却发现它随时可能因为某个敏感词而“降智罢工”,这种割裂感恐怕是当下所有AI玩家都要面对的阵痛。国产模型如DeepSeek V4-Pro Max虽然在传统基准上紧追不舍,但在这种长周期Agent任务与极致能力上,Fable 5依然划出了一道深深的护城河。
这头被戴上镣铐的怪物,究竟是守护人类的利剑,还是让人窒息的牢笼?也许只有时间能给出答案。
文章来源: 大国AI导航 | 综合财联社、新浪科技、36氪等报道及Anthropic官方公告撰写。