雷火·竞技-Claude深夜炸场!放出史上最强「危险级」模型Fable 5,价格太逆天

发布日期:2026-07-07 18:05:43 来源:雷火竞技 阅读量:28

  首页财产ai正文 Claude深夜炸场!放出史上最强「伤害级」模子Fable 5,价格太逆天 北京时间6月10日凌晨,Anthropic推出Claude Fable 5/Mythos 5,前者面向公家,后者用在受控项目。Fable 5跑分领先,能力强但价格贵,将鞭策年夜模子竞争。 2026-06-10 11:45 ·微信公家号:雷科技 我是小雷 我是小雷 AI投资人解读· Fable 5于多项跑分评测中体现优秀,年夜幅领先敌手,于繁杂代码处置惩罚、长使命履行、视觉及空间推理等方面上风较着,收集安万能力强。· 价格昂贵,输入输出token价格远高在竞品发布撞上价格战,或者劝退平凡开发者收集安全等敏感问题触发审查,或者成工程问题。总结:Fable 5机能强盛,具有投资潜力,但高价格与非凡审查机制带来危害,需综合评估其贸易远景与投资价值。内容由AI天生,仅供参考

北京时间 6 月 10 日凌晨,Anthropic 于没有任何预热的环境下,放出了旗下最强盛模子 Claude Fable 5/Mythos 5,前者面向公家开放,后者继承留于 Project Glasswing 如许的受控项目里。

Fable翻译为“寓言”,假如只看名字,Fable 5 像是 Claude 产物线里又一个新成员。但根据 Anthropic 本身的说法,Fable 5 属在 Mythos-class 模子,是他们终究敢拿出来给平凡开发者及企业利用的公然版 Mythos,而Mythos翻译为“神话”。

129a1e8935b3f44fbc721f10532af422.png

(图源:Anthropic )

为何说「终究敢拿出来」?Mythos 这个名字,于已往两个月里险些等同在「伤害」。本年 4 月,Anthropic 发布 Project Glasswing,把 Claude Mythos Preview 交给 AWS、Apple、Cisco、CrowdStrike、Google、微软、NVIDIA、Linux Foundation、Palo Alto Networks 等少数安全伙伴,用在寻觅及修补要害软件缝隙。那时 Anthropic 的立场很明确,Mythos Preview 不做广泛开放,缘故原由很简朴,它的收集安万能力已经经强到可能被滥用。

c7e8d65cd44130b4da7b69c352919b83.png

(图源:Anthropic )

官方直言,Mythos 发明过年夜量高危缝隙,甚至包括重要操作体系、阅读器及要害软件里持久没人发明的问题。放于戍守者手里,它是安全东西;放于进犯者手里,它可能酿成下一代主动化缝隙挖掘机。在是,Mythos 被关进了 Project Glasswing。

直至今天凌晨,Anthropic 才终究把这个模子放了出来。Anthropic 给 Fable 5 加之安全分类器,高危害哀求可能拒答,也可能回退到 Opus 4.8。简朴来讲,他们给一个曾经经不克不及直接放出来的模子套上护栏,然后把它推向市场。雷科技AGI(ID:leikejiagi)熬夜收拾了关在这个模子的一些资料,但愿对于你有效。

A社再造模子「神话」,Fable 5成最强没有之一

Fable 5 的跑分看起来很是不讲武德。SWE-Bench Pro 上,它拿到 80.3%,高在 Mythos Preview 的 77.8%、Opus 4.8 的 69.2%、GPT 5.5 的 58.6%、Gemini 3.1 Pro 的 54.2%。假如只看这一项,它已经经是*梯队里最显眼的阿谁。

真正离谱之处于 FrontierCode Diamond,这个评测更靠近真实软件工程,它看的是模子能不克不及写出维护者愿意接管的代码。Fable 5 拿到 29.3%,Opus 4.8 只有 13.4%,GPT 5.5 只有 5.7%。这已经经不是多赢几个百分点的问题,上一代 Claude 及重要敌手都被拉开了间隔。

已往许多 AI 编程模子会写代码,但工程质量经常不不变,有些代码能跑,却很难维护;有些代码能过测试,放进真实项目还有是会出问题。FrontierCode 的残暴就于这里,它体贴模子有无工程咀嚼,能不克不及于繁杂代码库里做持久使命。Fable 5 于这里年夜幅* Opus 4.8,申明 Anthropic 此次真正进级的是 agent 编码的魂灵。

8357295750feafca2e593f9ee26dd5f2.jpg

(图源:Anthropic )

于Terminal-Bench 2.1 上,Fable 5 是 88.0%,Opus 4.8 是 82.7%,GPT 5.5 Codex CLI 是 83.4%,Gemini CLI 是 70.7%。这象征着于终端情况里履行使命、读报错、改代码、继承推进,Fable 5 已经经压过了 OpenAI 的 Codex CLI 组合。

跑分不是那末主要,Fable 5真正吓人的地方于在,它已经经像一个能于工程现场干活的模子。你把使命扔给它,它能读项目、拆使命、调东西、修过错、继承跑。Anthropic 发布稿里提到,Stripe 用 Fable 5 于 5000 万行 Ruby 代码库里做迁徙,把原本一个团队两个月的事情压缩到一天。这类案例即便带着营销身分,也挡不住 AI 编码正于从辅助写函数进入接受工程流程。

咱们拿 DeepSeek V4-Pro Max 做个不太得当的比照,其于 GPQA Diamond 上有 90.1%,LiveCodeBench 有 93.5%,SWE Verified 有 80.6%。这已经经是开源阵营里很是能打的成就,Qwen3.7-Max 于 GPQA、SWE Verified、Terminal-Bench 等标的目的也打出了存于感。对于在认识 DeepSeek 的读者来讲,这象征着国产及开源模子其实不弱,许多传统强基准已经经靠近最强闭源模子。

a9e9febfa73b2d3a9c140f3bf1d0679c.png

(图源:雷科技AGI制图)

但到了更靠近真实工程及长使命履行的指标,Fable 5 的榨取感忽然变强。SWE-Bench Pro 上,Fable 5 是 80.3%;DeepSeek V4-Pro Max 官方内外的 SWE Pro 是 55.4%;HLE with tools 上,Fable 5 是 64.5%,DeepSeek V4-Pro Max 是 48.2%;Terminal-Bench 虽然版本不彻底一致,Fable 5 于 2.1 上拿到 88.0%,DeepSeek V4-Pro Max 于 2.0 上是 67.9%。Fable 5全都断崖式*。

这些数字实在纷歧定彻底能申明问题,但标的目的很清晰,DeepSeek 强于性价比、开源及一批传统能力指标,Fable 5 强于最贵、最难卖出高价的使命,特别是长使命 agent、繁杂工程、东西协同及真实代码库处置惩罚。

视觉及空间推理也于猛涨,好比GDP.pdf 这种常识事情视觉使命里,Fable 5 是 29.8%,高在 Opus 4.八、GPT 5.5 及 Gemini 3.1 Pro。Blueprint-Bench 2 上,Fable 5 是 38.6%,略高在 GPT 5.5 的 36.2%,远高在 Opus 4.8 的 14.5%。这注释了为何 Anthropic 夸大 Fable 5 能从截图重修网页运用、从科学图内外提取切确数字。

到了 Fable 5 这里,处置惩罚图片、视频等多模态更像是把屏幕、图表、界面及代码连成一个完备使命链。它看懂一个页面时,有时机直接复刻页面;它读懂一张图时,也能把图里的布局酿成下一步操作。

Fable 5让 Anthropic 不敢彻底铺开的则是收集安全及生物能力。ExploitBench Cap% 上,Fable 5 是 78.0%,Mythos Preview 是 69.0%,Opus 4.8 只有 40.0%,GPT 5.5 是 34.0%,这个差距很是夸张。放于安全防备里,它象征着模子能帮企业及开源维护者更快发明缝隙;放于过错的人手里,它也会继承拉低进犯门坎。

0e2194b3d8afad8624a83c41f2e61c9a.png

(图源:Anthropic )

BioMysteryBench hard 上,Fable 5 是 46.1%,高在 Mythos Preview 的 29.6% 及 Opus 4.8 的 40.0%。Anthropic 还有提到 Mythos 5 于药物设计相干流程中带来约 10 倍加快,份子生物学假定于盲测中得到研究者偏好的比例约 80%。这听起来像科研利好,也充足让羁系者紧张。

Fable 5 不只是「更智慧」,而是强于长使命,强于工程交付,强于视觉理解,强于安全及科研这些高价值也高危害的专业场景。某种意义上,它就是 Anthropic 今朝可以或许被公共公然利用的最强盛模子,没有之一。

当所有人于降价时,Anthropic把AI卖成豪侈品

Fable 5 再强,也绕不开一个实际问题,它贵患上离谱。官方价格是每一百万输入 token 10 美元,每一百万输出 token 50 美元,作为对于比,Claude Opus 4.8 是 5 美元输入、25 美元输出,Fable 5 直接翻倍。

更难堪的是,它发布的时间点,正好撞上年夜模子打价格战。DeepSeek V4-Pro 当前 API 价格已经经来到每一百万输入 token 0.435 美元、输出 0.87 美元,V4-Flash 更低,输入 0.14 美元、输出 0.28 美元。

小米 MiMo-V2.5 系列也于 5 月尾完成*降价,海外版 MiMo-V2.5-Pro 一样是输入 0.435 美元、输出 0.87 美元,官方还有夸大最高降幅可达 99%。Google 这边,Gemini API 仍有年夜量低价模子可选,Gemini 3.5 Flash 是输入 1.5 美元、输出 9 美元;定阅层面,Google 还有把 AI Ultra 顶配套餐从 250 美元降到 200 美元。

fb6f101746c7bc3ad8970fe9ac0dec8d.png

(图源:雷科技AGI制图)

也就是说,行业一边于把 1M 上下文、agent 编码、多模态能力往低价区间里压,Anthropic 一边把 Fable 5 定于输入 10 美元、输出 50 美元。及 DeepSeek V4-Pro、MiMo-V2.5-Pro 比拟,Fable 5 的输入价格约莫高 23 倍,输出价格约莫高 57 倍。即便对于比 Gemini 3.5 Flash,也贵出数倍。这个价格足以劝退年夜量平凡开发者。

但 Anthropic 的算盘也很清晰,它不想让 Fable 5 去做自制模子能做的工作。一样平常问答、轻量写作、平凡代码补全,固然不必上 Fable 5。它卖的是年夜型代码库迁徙、长上下文文档阐发、繁杂企业流程、收集安全防备、科研假定天生这些高价值使命里的时间。用最扎心的话来讲就是,如果你感觉你的时间更值钱,那就上 Fable 5 吧。

假如一个模子真的能把两个月工程压成一天,它固然敢贵。但企业采购时会先算一笔账,好比模子价格只是*层,数据保留是第二层,合规是第三层。Fable 5 被列为 Covered Model,于 Claude API 上要求 30 天数据保留,不撑持 zero data retention(平凡数据保留),对于金融、医疗、法令、焦点研发团队来讲,这不是小事。

截屏2026-06-10 03.01.53.png

(图源:Anthropic )

还有有,Fable 5 还有有一个贫苦点,它于收集安全、生物等敏感问题上会主动触发安全审查,有些问题它会直接拒绝回覆,有些问题会改用能力衰一点的 Opus 4.8 往返答。对于平凡用户来讲,这可能只是「问着问着被拒了」,但对于企业来讲,这会酿成工程问题。

这就形成为了一个很是成心思的两个阵营,DeepSeek、MiMo、Gemini 于证实,强模子会愈来愈自制,愈来愈轻易被开发者及企业年夜范围挪用。Anthropic 则于证实,真正*、真正靠近出产力焦点的模子,反而可能愈来愈贵,愈来愈像豪侈等第基础举措措施。

但哪一个阵营才会是真实的将来?谁都说禁绝。

Fable 5 榨取感太强,友商的日子都欠好过了

Claude Fable 5 的发布,会让许多公司难熬难过。OpenAI 会难熬难过,由于 Anthropic 继承于 agent 编码及长使命上打出了存于感。Codex 周活已经经跨越 500 万,OpenAI 正于把 ChatGPT、Codex 及将来 AI researcher 酿成事情进口,但 Fable 5 的呈现提示市场,Claude 于繁杂工程使命上仍旧是一个必需当真看待的敌手。

Google 也会难熬难过,由于 Gemini 系统虽然平台化能力强,Ge妹妹a、NotebookLM、Gemini Live 都于努力变强,但于这张 Anthropic 官方跑分图里,Gemini 3.1 Pro 于多项测试里输了。Google 的上风于生态及分发,Anthropic 的上风于最强模子的尖刀能力。

国产模子也会被迫从头回覆一个问题,自制以外,还有能不克不及让用户把最难的使命交给它。DeepSeek V4 的 1M 上下文、开源权重及极低价格颇有杀伤力,小米 MiMo 的降价也会继承鞭策 API 市场往下卷,但 Fable 5 这类模子的存于,会一直提示市场,自制模子能笼罩年夜量使命,可最难的 5% 或者 10%,仍旧可能被最贵的模子拿走。

截屏2026-06-10 03.02.51.png

(图源:Anthropic )

Fable 5 的真正市场意义就是,它不会让所有企业立刻换模子,自制模子的价值也不会消散,但它把年夜模子竞争推向了一个另外一场竞争,将来市场会同时需要两类模子,一类是自制、不变、可年夜范围挪用的事情“牛马”;另外一类是昂贵、强悍、带着护栏、专门处置惩罚高价值使命的*东西。

Anthropic 有点像于用 Fable 5 告诉整个行业,咱们不介入每一一场价格战,但咱们卖的就是最有价值的部门,你不能不于采购时把我列入思量规模内,这恰是A社估值能逾越OpenAI的底层逻辑。

说白了,模子越强,问题越实际,它到底卖给谁,卖多贵,出了事谁卖力,这些已往看起来很遥远的问题,此刻已经经被Claude Fable 5 摆到了桌面上。

【本文由投资界互助伙伴微信公家号:雷科技授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。

-雷火·竞技