虎嗅

Fable5复活,第一批用户却沉默了

该文章尚未提供 Русский 解读,以下为中文版内容。

核心内容总结

Anthropic的AI模型Fable 5在被暂停半个多月后恢复访问,但状态大不如前:安全过滤变得异常严格(连问“大黄蜂会不会放屁”都可能被拒),经常回退到旧模型Opus 4.8,token消耗速度快到离谱,用户体验大幅下滑。不过,Fable 5本身能力依然很强,适合复杂工程、代码审查等高端任务,官方和网友也给出了一些“避坑省钱”的使用技巧。此外,Claude桌面版还推出了Linux测试版,进一步拓展了使用场景。

1. 复活背后:被漏洞报告逼停,加了更严的“安全锁”

Fable 5这次暂停,直接原因是Amazon研究人员发现:用特定提示能绕过它的安全机制,让模型生成软件漏洞利用代码。虽然Anthropic辩解说“没到Mythos 5那种攻击能力”,还拉同行(GPT-5.5、Kimi K2.7)下水说大家都能识别漏洞,但还是紧急停了Fable 5。

恢复后,Anthropic重新训练了安全分类器,能挡住99%的漏洞绕过方式,但代价是“敏感肌”附体:

  • 重点拦截攻击性网络安全(漏洞利用、恶意软件)、生物/生命科学内容(实验方法)、提取模型内部思考的请求;
  • 良性任务也会被误判:程序员问正常编码问题、医生科学家打招呼、甚至问“大黄蜂会不会放屁”,都可能被转去Opus 4.8。

官方承认生物/化学分类器没更新,覆盖范围太宽,改进还在路上——这期间相关领域用户只能忍。

2. 用户哀嚎:花钱买贵模型,却常拿到“低配版”回答

Fable 5的价格是Opus 4.8的两倍(输入10美元/百万token,输出50美元),但用户经常花高价却得到旧模型的结果:

  • 有网友3个大型提示花了90美元,30分钟用掉60%额度;
  • 一个简单问题就耗掉Pro计划5小时额度的2%;
  • 更气的是,明明付了Fable 5的钱,却因为安全误判被转去Opus 4.8,等于花贵价买低配服务。

社区里全是吐槽:“消耗快、产出没差距、频繁回退,简直灾难。”

3. 贵有贵的道理:Fable5到底强在哪?

虽然体验拉胯,但Fable 5的硬实力还是在线的,Anthropic定位它做“高难度任务”:

  • 复杂工程:一次完成需要多天迭代的系统实现,比如生成《火箭联盟》克隆版游戏、Godot里的蜘蛛侠荡网游戏(比GPT-5.5少出错);
  • 视觉理解:能准确分析密集技术图、网页截图,还会用工具处理模糊图片;
  • 企业任务:金融分析、表格/幻灯片处理更擅长;
  • 代码能力:bug查找召回率比Opus 4.8高,能查代码库和历史提交;
  • 多代理协作:擅长调用并行子Agent处理子任务,适合长周期自主任务。

Cursor官方也说它在CursorBench榜单稳居第一(就是成本最高)。

4. 怎么用才不亏?官方+网友的“避坑指南”

为了让Fable 5物有所值,官方和网友总结了一套技巧:

  • 官方建议

1. 别让模型展示内部思考(会触发拦截),用工具展示阶段性进展;

2. 明确任务边界:比如“不要加额外功能”“只输出评估不修改代码”;

3. 长任务要核对证据(失败就说失败,不隐瞒跳过步骤);

4. 建外部记忆:把规则/错误写成Markdown,后续引用(省成本);

5. 合理用子Agent:让分身处理子任务,主模型推进全局。

  • 网友省钱技巧

1. 只在高难度任务用Fable 5,少用“xhigh”档位(费token且质量提升有限);

2. 中文沟通更省token(测试显示中文token膨胀几乎为0,英文是1.4倍);

3. 把高消耗任务(代码库分析)交给其他模型,再把结果给Fable 5。

5. 小彩蛋:Claude终于拥抱Linux用户了

除了Fable 5,Claude桌面版推出了Linux测试版(支持Ubuntu 22.04、Debian12),功能包括Chat/Cowork/Code标签页、并行会话、可视化diff审查、集成终端等。但暂时没有屏幕控制、语音输入,Wayland下全局快捷键要看桌面环境,Fedora/RHEL还不支持。

这意味着Claude从网页端走进了Linux开发者的工作台,但“笼子”也更密了——安全限制越来越多,用户既要享受能力,又要忍受各种约束。

最后一句话总结

Fable 5是个“能力强但脾气大”的模型:适合复杂任务,但现在的安全限制和高成本让它很难成为日常选择。如果非要用,得学会“哄着它”(按指南调整提示)和“省着用”(选对场景)。Anthropic想平衡安全和体验,但目前看来,用户体验被牺牲得有点多。