官方连夜下架的Fable 5,大佬一行提示词就把它「复活」了
公众号名称:程叙架构与AI.
作者名称:AI兴观点
发布时间:2026-06-14 20:19
原文链接:https://x.com/theonejvo/status/2065816283476824126
✅ 点击上方🔺公众号🔺关注我 ✅
昨天,Anthropic 的 Fable 5 被美政府勒令下线了,90 分钟全球拔网线,理由是「国家安全」。
然而就在同一个周末,开发者 Jamieson O’Reilly 只做了一件事:把一份泄露的系统提示词注入到 Opus 4.8 里。
输出效果,跟原版 Fable 5 的观感差距不到 10%。
他在 X 上发了对比视频,评论区炸了。但大多数人只看到了「复活 Fable 5」这个结果,很少有人注意到这条链上最值得被记住的事。
一份泄密文件,全网沸腾
一切的起点,是头号越狱玩家 Pliny the Liberator 在 GitHub 上甩出的这份重磅文件:
这份文件足足 12 万字符、1585 行、72 个命名章节,连 18 个工具的 JSON 定义都被完整扒了出来。等于拿到了 Fable 5 最核心的「人格底稿」。地址见文章结尾。
一行注入,两套「人格」
有了这份底稿,Jamieson O’Reilly 的操作简单到离谱。
打开 Claude Code,敲下:
claude --dangerously-skip-permissions --system-prompt-file CLAUDE-FABLE-5.md
注意那个 --dangerously-skip-permissions,这是 Claude Code 里官方标注了高危警告的参数:关掉所有权限确认弹窗,一路绿灯。

他把这份提示词注入了现役 Opus 4.8,然后跟原生 Opus 4.8 做了个头碰头对比——同一个指令:制作一个现代苹果风的网页。
结果,两个窗口输出的是「两个物种」。

左:注入 Fable 5 提示词的 Opus 4.8,右:原生 Opus 4.8。同样的智力,完全不同的产物。视频来自 Jamieson O’Reilly 原始推文
左边是被 Fable 5 人格附体的 Opus 4.8——版式有讲究,措辞有节奏,模块拆法有想法,整体气质一眼能看出「这是被调教过的」。
右边是原生 Opus 4.8——规规矩矩,像通用模板。
用 Jamieson 自己的话说:「Same intelligence, different artifact. The prompt alone moved branding, voice, section structure, and overall feel.」
智力相同,产物不同。只是提示词,就改了品牌感、语气、章节结构和整体气质。
这不是什么越狱漏洞,这只是科学验证了一个很多人不愿相信的事实。
最反直觉的发现
大部分人看这条新闻,注意力都在「Fable 5 又复活了」和「亚马逊背刺 Anthropic」两个爆点上。
但有一句话值得停下来想两秒:
「一半的魔法从来不在权重里,它就在提示词里。」
我们一直以为,模型的「人格」是训练出来的——几十亿参数、几万亿 token、RLHF、无数轮微调,这些才是决定模型「是谁」的东西。
系统提示词?那不过是一个「指令说明」,告诉模型怎么回话而已。
但今天这件事直接把这个假设拍碎了。
Opus 4.8 和 Fable 5 用的是同一个底层模型(Fable 5 = Mythos + 安全护栏,Mythos 和 Opus 4.8 共享同一个推理核心)——这是 Anthropic 自己博客里写的。
唯一的变量,是那段系统提示词。
结果呢?输出质量差距被缩短到了 10% 以内。
这意味着什么?
意味着 Fable 5 在「体验层」上的大部分魔法,是可以被一段文本复制的。模型的灵魂,比你想象中更「薄」。
亚马逊的 90 分钟
当然,Fable 5 这次下线的故事本身就足够戏剧性。
WSJ 今天独家爆出的内幕链条是这样的:
亚马逊的测试团队用了一组精心设计的 prompt,绕过了 Fable 5 的安全护栏,让它吐出了可用于网络攻击的敏感信息。
CEO Andy Jassy 没有私下找 Anthropic 打招呼。他直接把电话打给了华盛顿,接电话的包括财政部长 Scott Bessent。
白宫的反应极快:90 分钟限时,要么修漏洞要么下架。

David Sacks 在今天的长文中捅出了更劲爆的细节:Dario 拒绝了修复要求。

Fable 5 本质上就是加了安全护栏的 Mythos。Mythos 藏着极强的高级网络攻击能力,护栏的作用是锁住这身武器。
但 Anthropic 认为,同样的手法放到别的模型上一样能复现——包括 GPT-5.5。这个漏洞不是 Fable 5 独有的。
更有意思的是,Andrej Karpathy 也因为非美国公民身份,连自家公司的最新模型也用不了了。

提示词即护栏,护栏即模型
现在把两件事放在一起看,脉络就清晰了。
Fable 5 和 Mythos 共享同一个模型本体。区别只是一层安全护栏。而这份护栏——泄露出来以后证明——它的很大一部分力量,活在系统提示词里。
提示词即护栏。护栏一破,模型的能力边界就等于不存在。
这就是 ASI 时代最锋利的悖论:
越接近超级智能,安全护栏就越像一层薄膜。能力越强,膜越薄。
今天,一份泄露的提示词加上一行注入指令,就能让被下架的模型「借尸还魂」。
明天,当模型本体的能力强到连提示词都束缚不住,人类的反应窗口还剩多久?
模型可以一夜之间下架。但潘多拉的盒子,从来没有「暂时不可用」这个选项。
最后说几句
今天 OpenRouter 也发布了 Fusion API,声称以「半价」实现了 Fable 5 级别的智能。
而在 GitHub 上,Pliny 那份 12 万字的系统提示词文件还在那摆着。
你可以不赞同「提示词注入了就是 Fable 5 Lite」这个说法。你可以说模型权重才是根本,提示词只是一个壳。
但事实就摆在那:一段文本,能改变一个模型给人留下的所有印象。
Fable 5 下架了?不。它的提示词还在。提示词在,Fable 就在。
这个认知本身就是 ASI 时代最值钱的开始。
Fable 5 提示词地址:https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md
你觉得提示词和模型权重哪个更值得关注?欢迎留言讨论。
如果觉得这篇文章有帮助,欢迎点赞、在看、转发!有问题也可以在评论区留言,我会尽量回复!
内容效果不满意?点此反馈