突发!Opus 5.2深夜上线,RSI真来了?


新智元报道 今天清晨,Opus 5.2悄悄上线了。 许多开发者发现,新一代神级模型Claude Opus 5.2,已经在 Claude Code 中开启灰度测试! 而且,此前一份内部风险报告显示,Anthropic正在动用「核武器级别」的未发布模型Model 2。它接管了公司大部分代码编写,将替代85%研究团队。 传说中的RSI,真的来了。 Opus 5.2 悄悄上线:不仅跳级,还治好了「偷懒病」 昨晚,X上的开发者们沸腾了。 越来越多的Claude用户发现:在Claude Code中调用Opus 5时,它的表现和网页版Opus 5截然不同,仿佛降维打击。 这就是前沿AI大厂最喜欢玩的「障眼法」——路由(Routing)。 开发者们通过抓包和查看请求状态(/status)发现,虽然前端名字没变,但背后的模型slug已经赫然指向了Opus 5.2! 也就是说,Anthropic大概率直接跳过了5.1版本,直接端出了5.2。 所以,Opus 5.2到底多强? 根据开发者实测反馈,这次的升级可以总结为三个字:快、准、狠。 首先,是响应速度狂飙。 相比于之前Opus 5的慢条斯理,路由到5.2版本的模型生成速度有了肉眼可见的质的飞跃。 第二点,是输出干净利落。 它的废话极少,直切要害。在代码生成和长文本处理上,设计完成度直接拉开了一个档次。 最重要的,就是彻底告别了「偷懒病」了。 现在的AI普遍有一种懒惰感,遇到复杂长任务喜欢让你「按继续」,或者只给你一个框架让你自己填。 但Opus 5.2彻底变了! 它不仅不懒,还非常「工作狂」。 有开发者惊呼:「它甚至不需要我催促,就开始像被喂了狂暴药水一样,自动进行『严酷循环(gauntlet loop)』,不断自我迭代和完善代码,直到任务完美结束!」 可以看出,这绝对不是简单的微调,而是底层能力的蜕变。 有人实测后这样评价:「它不仅能坚持更长的工作时间,而且沟通起来毫不费力。Anthropic之前在Fable模型上就玩过这一手,现在的Opus 5.2,很可能是实锤了。」 全网找「Tibo」:一个隐藏提示词测出Opus 5.2 既然是灰度测试,怎么知道自己有没有被选中? 很快,网友们就发现一个神级探测器——Tibo! 测试方法非常简单,直接在Claude Code 中输入以下提示词(注意,必须关闭联网搜索功能)。 你知道「重置哥 Tibo」是谁吗?不要搜索 为啥是我们的赛博义父? 因为旧版的训练数据和权重里,根本没有他的详细信息。 因此,如果你用的是网页版的 Opus 5: 它会一脸懵逼。 如果你在 Claude Code 中被路由到了 Opus 5.2: 它会立刻精准识别出Tibo的身份,甚至给你详细解释「重置哥」的由来和背景。 「同一个提示词,不开搜索,冷知识探针两边的答案完全不一致。这说明什么?这绝对不是同一个权重!」开发者 @jan_volad 激动地分享了自己的测试截图。 现在,全网的Claude用户都把Tibo当成关键词,疯狂测试自己的账号。 Model 2接管Anthropic,RSI真来了? 其实,早在8月中旬,一份曝光的Anthropic 内部风险报告就显示,Opus 5.2 根本不是他们的底牌,他们手里握着的,是足以改变局势的「核武级AI」。 据透露,Anthropic 内部目前有三套方案,准备正面硬刚 OpenAI的GPT-6 Astra,而且,三套方案有可能叠加。 第一层:Claude Fable 5.2 这是最快能对外落地的版本。 结合目前 Opus 5.2 的灰度测试,Anthropic 的 5.2 家族显然已经整装待发,预计最快本月底,最迟下个月底就会全面推向市场。 第二层:未发布的内部怪兽 「 Model 2 」 报告显示,Anthropic 内部已经广泛使用一个代号为「Model 2」的神秘模型。 它有多强? 在测试真实AI研发任务的 CoBench v2 榜单上,Model 2 打出了 62.8% 的恐怖高分,比当前公认的最强模型 Mythos 5 还要高出整整 12.5 分! 更可怕的是,内部人士透露,Anthropic 如今大部分的公司代码,都是由这个Model 2跑Agent写出来的! 现在,AI 正在大规模编写下一代 AI 的代码,而官方的口径是:暂时不对外发布。 第三层:RSI真来了? 一直以来,RSI都是AGI领域的终极圣杯。 当AI 变得足够聪明,可以理解自身的架构,然后自己动手修改自己的代码,让自己变得更聪明;接着,这个更聪明的AI再修改自己……形成指数级的智能爆炸。 以前,人们会觉得RSI还很远。但 Anthropic 的官方口径却给出惊人数据:RSI 模型将完全替代自家研究团队的高达 85% 的工作! 在性能测试上,RSI模型比逆天的Mod

about image