新智元报道 谁能想到,谷歌的Gemini 4 Argon还没来,下一代模型的爆料就来了。 就在刚刚,外媒曝出,谷歌Gemini 4下一代模型Carbon,已经作为绝密杀器」,悄悄上线测试了! 据悉,谷歌目前正在内部编码平台上测试下一个代号为「Carbon」的检查点。 新版模型的性能已经逼近 Opus 5.5,而多位员工透露,递归自我提升(RSI)是取得这一进展的关键。 多位内测员工试用完直呼:「太强了!」 不过话说,这两个月OpenAI有Astra,Anthropic有Opus 5.5,谷歌啥时候能放出来一个真正能用的大模型? Argon还没发,Carbon先偷跑!谷歌内部彻底杀疯了 今天,令人兴奋的好消息来了:谷歌近期在 Antigravity中新增了对 Gemini 4 Argon 模型的引用,包含低、中、高三种推理强度。 现在,Carbon也来了,据说还有个内部编码工具Jetsky。 用一句话来形容现在的谷歌内部,就是进度惊人,卷到飞起。 10月1日,谷歌Gemini 4 Aargon发布,据说在网络安全、法律和金融等领域的基准性能实现了突破性的提升。 然并卵,直到今天,也没有哪个普通用户能真正用上。 就在大家怀疑谷歌是不是又在「PPT发布」时,一份泄露的内部文件和截图直接把吃瓜群众看傻了。 这瓜保真吗?不知道。 如果Gemini 4 Argon真如图中所示,在多项基准测试中打败GPT-6 Astra和Opus 5.5,那谷歌毫无疑问会重回王座。 但是万众瞩目下,Argon一鸽再鸽。 原来,谷歌的工程师们根本没空管Argon什么时候公开发布,因为他们已经沉迷于测试一个名为「Carbon」的新版本检查点,不可自拔了! 据爆料,这个神秘的Carbon模型在过去几天内,已经被接入了谷歌内部的编码平台Jetski中。 这可不是什么简单的修修补补,一位刚刚参与过测试的内部员工激动地对Business Insider表示:「在编程任务上,Carbon感觉简直就像是Opus 5.5!」 要知道,Opus 5.5可是目前Agentic Coding领域聚堆的天花板。 此前,有不少谷歌员工私下吐槽,早期的Argon版本在某些复杂代码任务上略显滞后,顶多也就是Claude Opus 5的水平。 甚至Gemini 4 Argon直接沦为测试背景板。 总之,Gemini 4跑分没输过,实测拉完了。 大V @Token Gremlin 用一个极具画面感的段子,无情地扒下了谷歌的底裤: 谷歌普通的一天: 员工 1:「老板,我们有比 Opus 5.5 更好的模型吗?」 员工 2:「就我测试的结果来看,没有。那些假基准测试说我们有,但差得远呢!」 劈柴哥:「要不我们就告诉大家它比 Opus 5.5 更好,但不让任何人测试?」 但Carbon的出现,直接把这个差距填平了! 员工们在内部Slack的聊天记录是这个画风—— 「感觉这玩意儿完全可以媲美Opus 5.5了!」 「Carbon真的是出奇的强!」 「新的Gemini pro next模型手感太棒了!」 总之,谷歌内部正以疯狂的速度迭代Gemini 4系列。 甚至有内部文件显示,除了Argon和Carbon,他们还在测试一个叫「Barium(钡)」的模型。 看来,谷歌是跟元素周期表杠上了。 核心大招曝光!RSI究竟有多恐怖? 如此短的时间里,谷歌怎能让模型完成如此大的飞跃。 答案,就是RSI。 多位谷歌员工在爆料中不约而同地提到了这个词,将其视为当前Carbon取得重大进展的关键。 它允许AI在完成任务的过程中,自己发现代码中的错误,自己生成更优的解决方案,然后再把这些更聪明的逻辑内化成自己的能力。 每一次迭代,它都比上一次的自己更聪明;而它越聪明,它进化的速度就越快! 当一个Opus 5.5级编程能力的AI,24小时自我优化,迎来的将是指数级爆炸。 不过话说回来,实现RSI的貌似不止谷歌一家。 有业内人士分析指出,谷歌最近显然是理顺了内部的组织架构重组,开始集中火力猛攻技术痛点。 一位大V观察者在X写道:「我希望看到谷歌每个月都能发布一个明显强于竞争对手的检查点,这样我才会认同那个战无不胜的谷歌已经回归。」 而目前Carbon在内部测试中的炸裂表现,似乎正在证明:RSI已经在谷歌内部启动了。 是「真王者」还是「平庸之作」? 不过,虽然谷歌内部嗨翻了天,外界却表现出了冰火两重天的态度。 毕竟,谷歌在「发布前削弱模型」这件事上,有不少黑历史。 在X上,关于Carbon曝光的讨论已经两极化。 有乐观派如网友 @Haleeeemahh,直接甩出了之前大会上的基准测试截图,力挺谷歌:「Gemini 4 Argon其实已经击败了Opus 5.5!看来谷歌团队在上次活动中真的没有夸大其词。现在又来个和Opus 5