首页财产ai正文 方才,Claude Mythos 5发布!5000万行代码1天弄定 Anthropic推出Claude Fable 5与Claude Mythos 5,前者面向公共,后者供少数用户,新模子于多范畴体现精彩,还有先容了相干特征与价格。 2026-06-10 10:53 ·微信公家号:量子位 存眷前沿科技 存眷前沿科技 AI投资人解读· Anthropic推出Claude Fable 5与Claude Mythos 5,Fable 5面向所有效户,Mythos 5仅对于少数受信托用户开放。于软件工程、视觉、长上下文等方面能力凸起,且API订价降低。· 危害提醒:Fable 5分类器可能误判正常哀求数据留存对于企业客户是实际问题模子价格仍较高。总结:两款新模子揭示强盛实力与潜力,虽有危害,但于当前AI市场极具竞争力,值患上存眷其后续成长和运用体现。内容由AI天生,仅供参考
Anthropic遮讳饰掩两个月的“神话”Mythos,终究降临了——
自家有史以来最强悍的年夜模子旗舰,分两个版本端上桌:Claude Fable 5与 Claude Mythos 5。

Fable 5是加了防护网版本的Mythos**,面向所有效户开放。
一旦用户发问触发危害分类器(好比试图让它写歹意软件),体系就会主动降级挪用上一代Claude Opus 4.8往返答。
Mythos 5是原汁原味的满血版“Mythos”,但只给少数受信托用户利用。
它于收集安全等范畴排除了安全限定,官网称其“拥有全世界最*的网安攻防与生物科研纯血能力”。
官方暗示,Fable 5及Mythos 5的自立运行时间比以往任何Claude模子都长。
小小叹个气?前沿AI,最先进入权限时代了。
并且就于Anthropic郑重其事地呼吁全数AI研究马上住手后没两天……
不懂Dario怎么也最先走上奥特曼每一次为自家新模子、新产物提早营销造势的老路,还有是阵仗极年夜的那种。
(我知道A社有本身的原理,但我还有是报以一个微笑)。
不外还有是有非技能层面闪开发者比力欣慰的动静,这两款新旗舰的API订价直接把以前的预览版砍失了一半以上:
每一百万输入Token仅需10美元,每一百万输出Token为50美元。

好了,我们迅速进入技能相干环节,冲——
双版本Mythos来了!官方给“Token效率”画了重点
先说个环境。
官方的发布日记及业内评测中没有像先容Fable 5那样,为Mythos 5开列一长串尺度的、公然的 Benchmark跑分榜单(好比 MMLU、GSM8K、SWE-bench 等)。
不外鉴在两者是统一底层模子,二者实在可以当作统一内核的“镜像两全”,基础技能指标彻底一致。
以是咱们只能先看看今朝官方渠道重要公然的Fable 5的体现。
根据Anthropic本身的说法,Claude Fable 5是今朝最强的公然Claude,也是Fable系列*次进入Mythos级能力。
它的上风重要集中于几个标的目的:软件工程、繁杂常识事情、视觉、长上下文、影象能力,以和生命科学研究。
更要害的是,使命越长、越繁杂,Fable5比拟已往Claude的上风越较着——申明Fable5的重点不是单轮问答更美丽,而是能接住长周期使命。
咱们没关系用数据及硬核Demo,来拆解这代神话级模子的统治力:
软件工程:高难度基准打穿,从“修Bug”到“全主动雄师”
于权衡模子解决真实世界、繁杂软件工程问题能力的SWE-bench Pro评测中,Claude Fable 5飙出了80.3%的高分。
作为对于比,竞争敌手的*主力模子GPT-5.5的患上分为58.6%。

于Cognition的Frontier Code评测——这个评测更注重模子能不克不及完成坚苦编程使命,同时满意高质量出产代码库的尺度——中,Fable 5于中等推理强度下就拿到前沿模子最高分。
FrontierCode该基准极难饱及。
不外即便于“中等努力(Medium effort)”模式下,Fable 5患上分也高寓所有前沿模子之首。

官方给出的*个典型案例来自Stripe。
于一个5000万行Ruby代码库中,Fable 5完成为了一次全库迁徙。这个事情假如让一个工程团队手动做,原本要两个多月。
Fable 5呢?仅仅用了一天。
此外,于端到端前端开发基准ViBench(Vibe-coding benchmark)上,Fable 5险些把基础开发用例直接打到饱及,实现了真实的“一枪流(One-shot)”天生运用。
原生视觉:不要脚手架,盲买通关《宝可梦》
知名科技媒体VentureBeat于《Anthropic brings Mythos to the masses with Claude Fable 5, its most powerful generally available model ever》一文中吐露,于专注在视觉文件推理的基准测试GDPpdf上,Fable 5及Mythos 5于不借助外部东西的前提下拿到了29.8%的成就。
作为对于比,Opus 4.8患上分为22.5%,GPT-5.5患上分为24.9%,Gemini 3.1 Pro患上分为16.7%。
Anthropic官方也猜各人看一堆数据很枯燥,在是放出了Fable 5打游戏的Demo,更具直接视觉效果。
此前的Claude模子假如想玩RPG游戏《宝可梦·火红版》,必需于外部为其配置一套极为繁杂的“脚手架”(包括舆图导航赞助、内存游戏状况读取等)。
此刻,Fable 5实现了纯粹的“原生视觉盲打”。
仅凭一张张原始的游戏屏幕截图,于没有任何舆图外挂的条件下,它彻底自立推演、计谋计划,硬生生买通关了整部游戏。
不仅云云,因为其超长序列的专注度,当给它配置了长期化的文件级内存后,它于嬉戏卡牌肉鸽游戏《杀害尖塔》(Slay the Spire)时,体现直接飙升了3倍,达到终极星体的几率一样暴涨3倍。
长上下文及影象能力重点进级,随手夸大了下“Token效率”
长上下文及影象能力也是此次进级的重点。
Anthropic称,Fable 5能于百万级Token的持久使命里连结专注,还有能使用本身的条记改良输出。
官方拿SlaytheSpire做了测试,给模子接入长期化文件影象后,Fable5的体现晋升幅度是Opus4.8的三倍,达到终极章节的频率也晋升了三倍。
这实在是Agent能力里很是底层的一环。
一个能永劫间干活的AI,必需可以或许记患上本身做过甚么、错过甚么、下一步为何这么做。没有不变影象,自立使命就很轻易酿成一场年夜型掉忆现场。
为此Anthropic还有尤其夸大了Token效率(这也是这代模子的一个要害标的目的)。
越是能永劫间自立事情的模子,越会耗损年夜量Token。
假如模子一边很强,一边很“费话”,成本很快会高到让企业肉疼。
Fable 5夸大Token效率,素质上是于解决Agent化落地里的帐本问题。
金融、法令与运营:初次冲破 90% 年夜关的逻辑黑洞
于考查高级阐发推理能力的Hebbia金融基准测试(Finance Benchmark for senior-level reasoning)中,Fable 5拿到了行业最高分。
于长篇文档推理、繁杂的图表及表格解读、以和多步调根因阐发上,Fable 5实现了双位数的超过式增加。
于量化生意业务年夜厂IMC及Optiver的实测中,Fable 5险些拿满了其生意业务阐发评估的全数权重(包括事实检索、观点推理及指望值计较),且揭示出惊人的不变性——于屡次反复运行中,输出成果的分数彻底一致。
数据阐发平台 Hex给出的评价是如许的:
Fable 5是行业内*个于咱们的焦点阐发基准(笼罩极为繁杂、长周期阐发使命)中冲破90%患上分年夜关的模子,比Opus晋升了整整10个百分点。于最刁钻的发问中,它体现出了人类专家级另外微不雅评判力。
前沿科研:满血版Mythos“以小胜年夜”100倍的模子
于前沿物理学研究上,草创公司VibeCAD及物理研究机构测试注解,Fable 5仅利用了1/3的推理Token,于36小时内产出的物理研究结果,就迫近了GPT-5.5耗时四天才跑出的成就。
以和仍旧有点藏着掖着的Myhtos终究于这一板块现身了。
Anthropic暗示,于生物医药范畴,满血版的Mythos 5于彻底没有人类协助的环境下,已经经可以自力履行一个生物学家的全数事情流:选择卵白质联合位点、自立调理并运行各种生物信息学东西,甚至于遭受运行掉败时本身 Debug。
它设计出的14个卵白质靶向复合物中,有9个已经经进入了试验室的真实药物研发管线。

Anthropic还有夸大,Mythos 5“是咱们*可以或许连续孕育发生新奇且惹人注目的科学假定的模子”。
于与Opus系列模子的盲法直接对于比中,科学家于80%的环境下更偏向在Mythos的份子生物学假定,而且已经将此中几个假定推进到试验验证阶段。
与此同时,Mythos 的一个假定——一种关在年夜肠杆菌卵白的新机制——于另外一家自力研究统一问题的试验室的研究《A newly identified detoxification system protects uropathogenic Escherichia coli from reactive chlorine species》中获得了证明。
更夸张的是于基因组学研究中,Mythos 5自立事情了一周多,拼凑了138个物种的单细胞数据,并自立设计练习了一个定制的微型呆板进修模子。
这个由AI练习出来的、体积小了100倍的微型模子,于体现上直接击败了前不久方才发表于《Science》杂志上的最新科研结果。
呼吁住手AI研究后,“伤害能力”好像被做成产物机制
此次最成心思之处,应该患上是Anthropic给Fable 5套上的防护网。
正确来讲,Fable 5暗地里挂了一组自力分类器。
这些分类器会检测用户哀求是否触及收集安全进犯、生物及化学危害,以和模子蒸馏。
一旦触发,Fable 5就会拒绝本身回覆,转而把哀求主动转交给Claude Opus 4.8,并奉告用户发生了降级。
有点意思哈。
已往的年夜模子于安全这一块,凡是是让模子拒绝,说甚么“抱愧,我没法为你提供帮忙”“对于不起我不克不及回覆”“对于不起我不克不及理解你的意思”之类balabala。
Fable 5换了一种做法。
它不做纯真拒绝了,而是做模子路由。
平凡问题由Fable 5处置惩罚,一旦被辨认到有问题是高危害问题,模子马上被切到Opus4.8。
Anthropic的意思是,Opus4.8自己也是强模子,降级回覆的体验总比直接拒绝要好的吧?~
这套设计现实把能力及安全拆开了。
你一样平常利用的是Mythos级能力。
但面临一些敏感、进犯性、诡计逃狱等问题时,Anthropic丝滑切换老版本模子为你办事,让你手里趁手的东西,忽然就没那末趁手了。
(重要提防收集安全、生化范畴及模子蒸馏方面的一些问题)
Anthropic给出了数据——
好动静,跨越95%的Fable 5会话不会触发降级。
也就是说,对于在绝年夜大都写作、代码、阐发、研究及办公使命,用户能拿到的体验基本靠近Mythos 5。
但还有有剩下不到5%的哀求,会进入更严酷的安全路径。
官网注解,高危害范畴重要有三类。
*类是收集安全,第二类是生物及化学,第三类是模子蒸馏。
这套机制暗地里,实在是前沿模子产物形态的一个变化。
安全再也不只是模子回覆前的一句免责声明,也不只是写于体系卡里的政策描写。
它酿成了分类器、模子路由、权限分级、数据留存、红队测试配合构成的产物架构。
固然,价钱也来了。
Fable 5的分类器调患上比力守旧,正常哀求也可能被误伤。
好比生物学家研究病毒,安全工程师做授权攻防练习训练,均可能于合理使命中触发降级。
Anthropic本身也认可,当前护栏比抱负状况更严酷,后续会降低误伤率。
另外一个价钱是数据留存。
从Fable 五、Mythos 5以和后续划一级模子最先,Anthropic要求Mythos级模子所有流量保留30天,笼罩*方及第三方利用场景。
官方夸大这些数据不会用在练习,只用在安全监控,包括辨认繁杂进犯、新型逃狱及跨哀求进犯。
对于平凡用户来讲,这可能只是条目里的一行字。
但对于企业客户来讲,这就长短常实际的数据管理问题。
想用最强能力,就要接管更高档级的安全审查及数据留存。
不成防止的,前沿模子的成本,也不只表现于API账单上。
价格方面,Fable5及Mythos5同一订价为每一百万输入Token10美元、每一百万输出Token50美元。
确凿,比拟Claude Mythos Preview自制不少,但仍旧是高价模子。
一句话说,Fable5确凿强,但不会自制到可以随意烧。
这也注释了为何Anthropic要同时夸大能力、安全及Token效率。
内测AI学者体验:AI越强,人越像甲方
闻名AI学者、沃顿商学院传授埃森·莫里克(Ethan Mollick)于率先拿到测试权限后,撰写了一篇长文。
其行文逻辑直击这场技能革命的焦点素质——
人类与年夜模子之间的协作范式,发生了底子性、不成逆的逆转。
他让Fable 5做了一个等时圈舆图。
这个使命听起来不算玄乎,但真做起来很是贫苦。
它要查航班、查铁路时刻、判定门路速率,还有要处置惩罚差别国度、差别交通方式、差别时间成本之间的瓜葛。
Fable 5本身启动多个代办署理去查资料,拿到了2200多个详细航班信息,还有抓取了TGV、新干线等铁路数据,以和列国门路速率信息。

末了,它把这些资料整合进一个可用的舆图项目里。
这件事的重点于在Fable 5把一个恍惚方针拆成为了研究、信息汇集、设计、编码、验证等多个环节,而且本身往前推进。
这及已往的年夜模子体验不同很年夜。
在是,莫里克提出了一个深刻的洞察。
于已往,人类利用年夜模子就像一个“巫师(Wizard)”,你必需手把手地去引导它、驾御它(Steer),精雕细琢每一一句 Prompt,经由过程不停的对于话提醒词来“念咒”,AI才能委曲变出一个戏法。
而面临Mythos级另外模子,人类正于沦为“援助人(Patron,这里我觉得翻译为“甲方”更贴切一些?)”或者者“委托人”。
莫里克传授用Fable5事情,觉得已经经不比是于操作一个东西,更像是于委托一个小型事情室。
此外,于莫里克的现实测试中,他再也不需要事情于最微不雅的指令层。
他直接向Fable 5喂进了一个长达15页、极为繁杂的项目设计文档,然后留下宏不雅的需求描写。
接下来的9个多小时里,Fable 5于后台处在彻底自立(Autonomous)的运行状况。
它本身生出了一个Agent事情流,内部调理多个小Agent别离去弄调研、撰写纲领、彼此校对于、推翻过错假定、纠错重来。
人类甚至不需要参与这个事情流半步。
9小时后,一个极高质量的制品直接交付到了莫里克眼前。

这就是所谓的“事情室(Studio)”隐喻。
之前,咱们用年夜模子是雇佣了一个姑且的、需要重复沟通的自由职业者;此刻,你用Fable 5,等在你用几$的Token,刹时雇佣了一整家好莱坞级另外设计院、或者者一个*的科研所。
你不需要体贴它于黑盒里做出了几多个微不雅决议计划,你只需要饰演阿谁于终极制品上具名的“甲方”。
这类年夜模子长文本上下文(Context)与自立逻辑的联合,让Context再也不仅仅是一个“内容容纳器”,而是完全沉淀为了一个能自立推演、永劫运行的“新型智能操作体系”。
换句话说,AI越像承包方,人类越像需要具有验收能力的甲方。
小插曲,为了更直不雅、更有趣地展示,传授还有让它天生了一系列游戏供各人试玩。
这些游戏都是基在Claude Code的一个初始提醒,Fable 5需要按照我提供的恍惚提醒天生一些可行的步伐,以后我会给出一些分外的提醒,并赐与一些鼓动勉励(例如“做患上更好”)或者反馈。
因为Claude Code没法天生图象,以是所有的美术作品或者3D对于象都是彻底经由过程数学运算天生的,没有利用任何外部资源。
这里放一个抛硬币游戏的demo:

提早内测Fable 5后,传授末了暗示“终极的结果使人印象深刻”。
可是,特别是于着手处置惩罚更严厉的项目时,传授经常感觉利用这个东西既使人愉悦又使人不安。
愉悦的地方于在,我只需提出要求,它就能实现。不安的地方也于在,我只需提出要求,它就能实现。
简直。
回到Anthropic此次发布。
有的人认为最主要的是Mythos终究半明牌了,有的人认为最主要的是前沿AI产物正于进入新形态。
一个更强的模子上桌了。
但Anthropic先给它系上安全带,然后才把钥匙递给所有人。
有人欢呼,有人焦急,有人于通宵调试代码,只为追上那条不停向前疾走、甚至已经经最先离开人类微不雅视野的智能曲线。
Three More Things
一、留意窗口期。从今天到6月22日,Pro、Max、Team及企业版用户可以避免用度Fable 5。
但6月23日起,还有想用Fable 5,就患上分外买usage credits了。
二、Anthropic说,一旦产能跟上,Fable 5会从头做成定阅标配。
API及按量付费的企业客户不受这个节拍影响,今天起照常挪用。
参考资料:[1]https://www.anthropic.com/news/claude-fable-5-mythos-5[2]https://www.oneusefulthing.org/p/what-it-feels-like-to-work-with-mythos[3]https://www.biorxiv.org/content/10.64898/2026.03.12.711259v1
【本文由投资界互助伙伴微信公家号:量子位授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-雷火·竞技