打开APP

AGI只差最后一步了

4月Anthropic发布Mythos模型,因强大未公开。昨上线Fable 5,测试数据显示其性能卓越,同时介绍了安全措施、价格及对AI产业的影响。

大家应该还记得4月份的时候,Anthropic发布了名为Mythos的模型。

看名字就知道多厉害了,神话。

当时,据说给50家企业客户找出了一万多个高危漏洞,震动了整个行业。

这个消息,一度导致网络安全股全线暴跌,大家应该还有印象。

因为过于强大,担心被滥用,“太危险不能公开”,所以不开放给公众。

直到昨天晚上,Anthropic给Mythos模型加上了安全分类器,正式上线了Fable 5。

至于未阉割的Mythos 5,目前只对白宫、网安防御者和透翅蝶计划等大约200家经过严格审查的机构开放。

如此谨慎,很难不让人联想到最近火热的AI动画《天使引擎》。

笼子里锁着的,是那位“天使”吗?

即便现在不是,也不远了。

01

根据Anthropic官方发布的测试数据,以及首批企业合作伙伴反馈的实测报告,Fable 5的强大可以用叹为观止四个字来形容。

先看跑分。

自动编程评测榜单SWE-Bench Pro,Claude Fable 5通过率80.3%,它的“母亲”Opus 4.8是69.2%;GPT-5.5是58.6%;Gemini 3.1 Pro只有 54.2%。

前沿代码评估,Fable 5达到29.3%,Opus 4.8是13.4%;GPT-5.5仅仅5.7%。

……

其中的差距,就相当于在冷兵器时代突然有人掏出了机关枪。

其余的,软件工程、独立科研假设、药物分子设计、模型蒸馏与极限压缩、长上下文理解等等等等,在几乎所有测试中,Fable 5都是*。

具体的大家可以去找视频看。

再看实战。

支付巨头Stripe拿Fable 5做了一个早期测试。他们有一个高达5000万行的历史遗留代码库需要做全库迁移。按照评估,这种规模的重构,即便交给专业团队,也起码需要两个月。

结果,把任务喂给了Fable 5后,它全程自己做规划、自己检查进度、遇到报错自己修正。仅仅用了一天时间,5000万行代码的迁移干完了。

这种表现,不是“强大”两个词形容就完事了。

从狭义的角度来看,Fable 5其实已经实现了数字经济层面的AGI。

原因在于,它表现出了真正的“长程代理能力”。

不论是GPT-5.5还是Gemin 3.5,更不必说其它更次一些的大模型,本质上都是在“应答”。

你踹一脚,它走一步。

遇到死胡同,它只能抛异常,撒娇说“对不起我只是个语言模型”。

说是工具,但其实用户还是需要深度思考,一步步引导AI给出自己想要的结果,并不轻松。

具备了内化的目标导向逻辑的Fable 5就不一样。

就像Strip的测试,当用户给它一个高难度的长线任务,分三步走:

建立子任务树;

调度不同的工具(网页搜索、数据库拉取、Python沙箱环境);

自我反思,发现跑不通,立刻换条路走。

人除了提出任务和接收成果,不再需要在一旁指指点点。

作为一个生产力工具,这已经非常*了。

但它和真正的AGI,依然是两码事。

Fable 5的强悍,是建立在它所处的代码库、科学文献等依然有一套底层的数学逻辑和结构定义。

它之所以能在长周期任务中不迷失,是因为克服了“长文本注意力衰减”这难题,在处理长达数百万token的复杂任务时,能够始终保持核心目标的对齐。

但一旦把它扔进一个完全混沌、缺乏数字规则、且人类自己都没整明白的物理现实社会泥潭里,它依然会因为“地基缺失”而产生逻辑断层。

如果用OpenAI提出的“人工智能五级标准”(1级:聊天机器人;2级:推理者;3级:智能体;4级:创新者;5级:组织)来衡量。

Opus 4.8是2级向3级迈进,Fable 5真正站稳了3级并向4级探索。

而从Opus 4.7到4.8用了43天,4.8到Fable 5只用了11天。

站稳4级需要多久?按照Anthropic如今更新频率越来越快的节奏来看,很可能在今年内就能实现。

即便最终的5级,乐观估计也只需18-24个月,是真正的只有一步之遥。

这个速度太快了,这也是为什么要给它加安全限制的*原因。

02

在Anthropic随模型发布的《System Card》和RSP评估报告中,Mythos 5在两项能力上出现了极其危险信号。

其一,Fable/Mythos底层模型在化学和生物学评估中,已经达到了CB-1级别。

意思就是,该模型具备了“合成并指导制造非新型生物/化学武器”的端到端能力,甚至给出优化某种高危病毒传播效率的基因序列修改建议。

如果一个具备大学本科生物基础的恐怖分子,拿到了解除封印的Mythos 5,完全可以通过不断提示模型,获取如何规避原料监管、如何在地下室搭建简易P3实验室、如何合成高致死性病原体的完整指导。

其二,网络攻击与漏洞利用。

在极早期测试中,Mythos 5就展现出了能够自主寻找、并攻破关键基础设施(如电厂、金融清算系统、医院网络系统)核心漏洞的能力,几秒钟就能生成针对性的零日漏洞攻击脚本。

今年4月份Mythos刚研发出来时,就有爆料说给50家初始合作伙伴找出了超过一万个高危级别的漏洞。

……

针对这两种情况下,直接把Mythos 5扔给大众,危险性实在太高。

必须把这只猛兽关进笼子里。

时隔两个月,Anthropic打造的笼子有两层。

*,静默降级路由机制。

Anthropic在Fable 5的前端部署了一套完全独立、反应极其敏锐的高精度分类器AI。

当用户输入一段复杂的、可能涉及网络攻防、生物化学、或者试图套取模型权重的隐蔽提示词时,分类器会立刻拉响警报,并是在后台静默地把会话切换路由到老款的Opus 4.8去回答。

第二,数据保留。

Anthropic与亚马逊昨晚联合宣布:不论是在*方还是第三方平台,所有调用Mythos模型的流量,必须强制执行30天的数据留存。

为什么?

因为真正的黑客或恐怖分子,智商大多都很高,他们不会在一个对话里直接问“怎么制造炸弹”,而是把问题拆解成100个看似无害的基础问题。

30天的全量数据监控,就是为了通过模式识别,捕捉那些单次对话看不出来的“切香肠式”恶意滥用。

正如Dario Amodei之前在公开场合警告过的:“AI导致人类发生灾难性风险的概率,有整整25%。

为了遵守公司内部制定的《负责任缩放政策》(RSP)以及《前沿合规框架》(FCF),Anthropic 必须亲手给这个巨兽戴上铰链。

于是,就有了Fable 5。

03

再聊价格。

Anthropic公布的官方标价是:每百万输入token10 美元,每百万输出token50美元。

太贵了。

现在的企业级Agent任务,为了追求高准确率,往往采用“多轮思考思考再思考”的链式逻辑,一轮吞吐可能就要吃掉2000万的输入token,然后吐出500万修改后代码。

算下来,单次任务就要450美元。

而且,Anthropic已经发出通告:现有的个人订阅(Claude Pro)中包含的Mythos模型体验窗口,将在2026年6月22日彻底关闭。

以后,个人用户要是真的拿它来工作,几十美元那真是眨眼就花掉了。

虽然说,随着技术更新,其价格最终必然会降下来,但等到那时它早就不是最强。

现状已经非常明显:最前沿的大模型变成了奢侈品,普通人根本用不起。

当然,对聚焦B端市场的Anthropic而言,这无可厚非。

问题是,前不久,谷歌还高调地宣布打价格战。

在竞争对手普遍降价抢市场的时候,为什么Anthropic敢逆势涨价?

因为Token价格是虚的,回报率才是根本。

企业客户根本不在乎一度电、一个Token多少钱,只要AI能*无Bug地完成整套工程流,这个溢价他们抢着付。

更关键的是,如今的网络安全战,已经彻底成为AI与AI之间的对抗。

由于Fable/Mythos级别的模型能瞬间找到系统漏洞,企业和国家机构为了防止被攻击,*的选择只能是高价向Anthropic购买Mythos 5的内网私有化防御服务。

简单来说就是收保护费:我造出了最恐怖的剑(Mythos 5),我怕伤人所以套上剑鞘卖给大众(Fable 5),但我同时把不受限的剑卖给防御部门,让他们用来拦截别人正在研发的剑。

防御AI的威胁,将成为每一个大型企业的刚需支出。

这将直接导致B端市场的高端预算将更加向Anthropic集中,而那些只能用来写写公文、发发邮件的廉价模型,只能在利润极低的C端市场互相肉搏。

可以预见,接下来,全球网络安全板块将迎来一轮由AI驱动的价值重估。

与此同时,“一人企业”也将很快成为越来越普遍的现象。

04

自带任务预算分配功能,支持记忆工和上下文管理,能像人一样去记忆、推翻、重来,能独立承接从需求文档到代码交付的全生命周期……

Fable 5和Mythos 5的出现,与其说是大模型技术的一次更新,不如说是AI产业分工彻底走向成熟的成人礼。

AI市场初步告别了“全员免费试用”的田园时代。

最*的算力和最深邃的智慧,将优先作为一种生产力战略物资,定向输送给最能产生商业价值的基建、科研和B端应用战场。

这是生产力爆炸的狂欢,也是劳动力市场的寒冬。

【本文由投资界合作伙伴微信公众号:格隆授权发布,本平台仅提供信息存储服务。】如有任何疑问题,请联系(editor@zero2ipo.com.cn)投资界处理。

相关资讯

相关企业

AI数据总览

帷幄杭州帷幄未来科技有限公司
融资时间2026-07-15 当前轮次C+++轮 融资金额4000万美元
AI
涉及机构: 招银国际(CMB International CMBI) 旗下专注于 AI 及前沿科技的基金日本三井住友银行 (Sumitomo Mitsui Banking Corporation SMBC) 旗下企业风险投资基金 SARF (SMBC Asia Rising Fund)三菱 UFG (MUFG) 旗下泰国大城银行 (Bank of Ayudhya) 企业创投 (CVC) 平台 Krungsri Finnovate弘章投资 (Charisma Partners)韩国现代汽车集团 (Hyundai Motor Group) 新加坡电信 (Singtel Innov8)
面壁智能北京面壁智能科技有限责任公司
融资时间2026-07-15 当前轮次战略融资轮 融资金额未披露
AI
涉及机构: 国家级基金央企汽车制造商等各类产业方知名财务投资人
知有无界知有无界(深圳)智能科技有限公司
融资时间2026-07-15 当前轮次天使+轮 融资金额数千万人民币
AI
涉及机构: 元禾璞华深圳新产投
幻码跃迁上海幻码跃迁量子科技有限公司
融资时间2026-07-14 当前轮次种子轮 融资金额数千万元
AI
涉及机构: 光源成长基金云启资本小苗朗程
爱诗科技北京爱诗科技有限公司
融资时间2026-07-14 当前轮次C轮 融资金额29.8 亿元人民币
AI
涉及机构: 阿里巴巴领投Lollapalooza Capital(王慧文家办)常春藤资本惠远资本钟鼎资本韩国未来资产OCBC 生态下 Lion X 基金蓝色光标CloudAlphaiGlobe Partners 等参与

最新资讯

热门TOP5热门机构 | VC情报局

去投资界看更多精彩内容
【声明:本页面数据来源于公开收集,未经核实,仅供展示和参考。本页面展示的数据信息不代表投资界观点,本页面数据不构成任何对于投资的建议。特别提示:投资有风险,决策请谨慎。】