刚刚,Opus 5.5跨级偷袭,直扑GPT-6

新智元
个人专栏
热度: 4869

Anthropic跳过常规迭代,秘密内测并即将发布Claude Opus 5.5,性能直逼甚至超越GPT-6 Sol与Astra,同时大幅降价并优化缓存成本;同步推进Fable 5.2强化3D生成与前端开发能力,形成双线组合拳,与OpenAI、谷歌在模型性能、价格和上市节奏上展开激烈竞争。

摘要由 Mars AI 生成
本摘要由 Mars AI 模型生成,其生成内容的准确性、完整性还处于迭代更新阶段。

Anthropic这回,怕不是憋了个大的?

所有人都在等Opus 5.2,结果最新线报来了:下一代版本号直接飙到5.5!

Anthropic

今天一早,开发者Lyra扒出猛料,代号为「claude-wafer-eap」的Claude Opus 5.5已经在偷偷内测了。

据说动作快的话,这周二就会突然砸出来。

Anthropic

摆明了,Opus 5.5就是冲着GPT-6去的,据传性能直接把Astra踩在脚下。

更狠的是跟着曝光的定价单:百万Token输入只要4美元,百万Token输出20美元。

Anthropic

这还没完,他们顺手还亮了另一张王牌,Claude Fable 5.2也在暗中铺路。

就在两天前,外媒爆出,A/在IPO之前必须扔个重磅模型出来,重新稳住市场信心。

现在看,这两张底牌一掀,好戏才刚开场。

Anthropic

Anthropic

Claude连跳两级直升5.5

或暴击GPT-6 Astra

如今,GPT-6还没捂热,Anthropic一刀就要砍过来了。

而这一切,偏偏发生在GPT-6 Sol、Gemini 4 Pro同周扎堆「灰测」的节骨眼上。

三家挤在同一个赛道,Anthropic选择用最粗暴的方式抢头条:跳级、降价、偷跑,一气呵成。

最先爆出Claude Opus 5.5的开发者Lyra,还透露了另一个细节,5.5可以打败gpt-6-sol

Anthropic

但更耐人寻味的,是这次跳级背后的动作:

7月24日,Claude Opus 5正式发布。在此之后,还短暂出现过一个5.2的测试checkpoint,现在又跳去5.5。

Anthropic根本没打算做常规迭代,这次从一开始,就是奔着放大招去的。

真正上手测过的老哥Harshith说了句大实话,「Opus 5.5这波直接赢麻了,比之前的Fable 5.1和Astra都要顶」。

他反手就让5.5搓了个Waymo无人车的3D模型,结果还原度高得吓人——

连捷豹的车标、顶上的激光雷达传感器这些小细节,全生成的明明白白。

Anthropic

更重要的是,成本仅要Opus 5的一半。

至于消耗的 Token,可以感受下这恐怖的产出量:输入才1.4k,输出了整整532k,缓存更是跑了41.2M读取+1.7M写入。

性能暴涨的同时,价格直接腰斩。

Anthropic

开发者Veee也下场凑了个热闹,让Opus 5.5基于Three.js写了一个网页端3D汽车展示器。

从渲染质量和交互上看,Opus 5.5做得比较扎实。

Anthropic

再来看个更硬核的测试,它甚至能「一把过」,直接输出一个3D交互式「瓦力机器人」控制台。

无论在UI布局、机械绑定,还是IP还原度上,都展现出了极强的专业度。

除此之外,不少参与内测的开发者反馈,这个新checkpoint的解题直觉、深层代码重构能力和长程多步骤规划表现,已经明显拉开了与现款Opus 5的代差。

性能狂飙,价格打骨折

伴随5.5版本消息流出的,还有一组未经官方确认的API价格。

按目前流传的口径,Opus 5.5的定价预计为——

每百万Token输入4美元、输出20美元。对比现役Opus 5的5美元/25美元,降价幅度约20%。

更关键的是,缓存机制的大幅优化。缓存读取降至每百万Token 0.2美元,缓存写入为5美元。

Anthropic

Anthropic

0.2美元的缓存读取单价,意味着企业构建长时间、长上下文的自主Agent系统的开销,将暴跌一个数量级。

这个价格策略意味着一件事:Anthropic正在把顶级模型从「奢侈品」变成「日用品」 。

Fable 5.2

也在暗中发力了

Opus之外,Fable这条线也有了新动静。

开发者Pankaj Kumar刚刚放出了Fable 5.2的尝鲜体验。

按他的说法,官方似乎正把5.1的悄悄切到5.2上,而自己碰巧拿到了这趟内测的「早鸟票」。

上手之后,他给出的评价相当高,Fable 5.2的3D生成能力不仅追平了Astra,甚至大有反超的势头——

不需要详细的prompt,就能准确分析你想要什么。

Anthropic

他试着用Fable 5.2建了个「悬崖别墅」的3D场景,无论是打光、材质反射还是氛围感,细节都挑不出毛病。

更夸张的是,它还能直接用Three.js一把梭生成完整的小游戏。

而且这模型的前端审美极其在线,配色、排版字体、界面布局挑不出一点毛病,完成度直接把前几代甩开了几条街。

Anthropic

下面这段演示,做了一张极其完整的爆炸拆解渲染图,把分层的光学模组、透明部件、精密内部硬件和光影细节层层剥开。

最终呈现的整图构图精致度,令人意外。

Anthropic

另一位开发者Chetaslua测试中,没喂任何现成素材,没开MCP插件,甚至不需要任何灵感草图,Fable 5.2纯靠原生JS硬写出一个「微缩世界」。

下面这只超可爱的Claude吉祥物,完全都是用纯代码一笔笔渲染出来的。

Anthropic

Anthropic

来自网友的同款测试。

Fable 5.2搭出了一个完整的、能跑能动的小型JS系统——

几十种完全不同的头部建模、面部微表情、动态效果、控制面板和交互逻辑,全在一次生成里严丝合缝地跑了起来。

Anthropic

最后再来看一组正面对决的实测,Fable 5.2和Astra到底谁更能打?大家直接看图感受:

Anthropic

一边用Opus 5.5夯实企业级基础设施,一边用Fable 5.2把控创意与前端开发。

Anthropic这套双管齐下的「组合拳」,节奏卡得异常精准。

硅谷三巨头激战

本周开打

如今,大模型圈的节奏,彻底被带飞了。

眼下的AI竞技场,早已不是某一家独领风骚的独角戏。

这轮技术大换代之所以让所有人坐不住,主要是Anthropic、OpenAI和谷歌步调出奇地一致,把战火引向了同一个关键战场。

三家神仙打架的技术路线图,也彻底摊在台面上了。

Anthropic

OpenAI:Astra抬高上限,坐等日常利器GPT-6 Sol

OpenAI之前放出的GPT-6 Astra,确实把科学推理和Ai智商拔到了新天花板。

但那高昂的Token推理开销,注定它只是个供在神坛上「屠龙刀」,普通工程师日常搬砖根本不敢敞开用。

也正因如此,最近大家在OpenAI API接口里扒出的gpt-6-sol,瞬间成了全圈子最翘首以盼的狠角色。

Anthropic

Anthropic:嘴上喊着降速,背地里掏出新版本

要论整出这一轮好戏的最大反差,非Anthropic掌门人Dario Amodei莫属。

就在上周,达里奥还在万字长文里大声疾呼,「AI狂飙太快了,行业需要降速」。

结果背地里,直接把Opus 5.2扔进了「回收站」,连跨两级掏出了Opus 5.5,准备周二突袭。

更狠的是这次的「价格自杀式冲锋」,以百万Token 4美元的骨折价,把顶配智力直接砸向OpenAI的腹地。

Anthropic

谷歌:鸽了四个月,就看Gemini 4 Pro了

谷歌这边,也是不能再等了。Gemini 3.5 Pro进化程度,连Flash也不及,内部直接取消发布。

Gemini 4 Pro,也就成为了「全村唯一的希望」。

在Arena实测中,4 Pro以代号「gemini-3.8-flash」出现,各项指标完全碾压。

Anthropic

Logan Kilpatrick更是直言,Gemini 4将是谷歌迄今为止规模最大的预训练项目,目标是「让谷歌重回巅峰」。

回头来看,「御三家」真正的神仙大决战,就在眼皮子底下这几天了。

Anthropic这次挥刀,既是砍向GPT-6,也是砍向自己的IPO焦虑。

跳级、降价、偷跑,明眼人都看得出来:在OpenAI开发者大会之前,把开发者的钱包份额抢回来。

Anthropic

本周二的硅谷,注定又将迎来一个不眠之夜。

这一局,你站谁?

参考资料:

https://x.com/lyraxana/status/2101668658711798083?s=20

本文来自微信公众号“新智元”(ID:AI_era),作者:ASI启示录,编辑:桃子

声明:本文为入驻“火星财经 专栏”作者作品,不代表火星财经官方立场。
转载请联系网页底部:内容合作栏目,邮件进行授权。授权后转载时请注明出处、作者和本文链接。未经许可擅自转载本站文章,将追究相关法律责任,侵权必究。
提示:投资有风险,入市须谨慎,本资讯不作为投资理财建议。
本内容旨在传递行业动态,不构成投资建议或承诺。