刚刚,谷歌下一代杀器Gemini 4 Carbon曝光,RSI大招逼近Opus 5.5
谁能想到,谷歌的Gemini 4 Argon还没来,下一代模型的爆料就来了。
就在刚刚,外媒曝出,谷歌Gemini 4下一代模型Carbon,已经作为绝密杀器」,悄悄上线测试了!
据悉,谷歌目前正在内部编码平台上测试下一个代号为「Carbon」的检查点。
新版模型的性能已经逼近 Opus 5.5,而多位员工透露,递归自我提升(RSI)是取得这一进展的关键。
多位内测员工试用完直呼:「太强了!」
不过话说,这两个月OpenAI有Astra,Anthropic有Opus 5.5,谷歌啥时候能放出来一个真正能用的大模型?
Argon还没发,Carbon先偷跑!谷歌内部彻底杀疯了
今天,令人兴奋的好消息来了:谷歌近期在 Antigravity中新增了对 Gemini 4 Argon 模型的引用,包含低、中、高三种推理强度。
现在,Carbon也来了,据说还有个内部编码工具Jetsky。
用一句话来形容现在的谷歌内部,就是进度惊人,卷到飞起。
10月1日,谷歌Gemini 4 Aargon发布,据说在网络安全、法律和金融等领域的基准性能实现了突破性的提升。
然并卵,直到今天,也没有哪个普通用户能真正用上。
就在大家怀疑谷歌是不是又在「PPT发布」时,一份泄露的内部文件和截图直接把吃瓜群众看傻了。
这瓜保真吗?不知道。
如果Gemini 4 Argon真如图中所示,在多项基准测试中打败GPT-6 Astra和Opus 5.5,那谷歌毫无疑问会重回王座。
但是万众瞩目下,Argon一鸽再鸽。
原来,谷歌的工程师们根本没空管Argon什么时候公开发布,因为他们已经沉迷于测试一个名为「Carbon」的新版本检查点,不可自拔了!
据爆料,这个神秘的Carbon模型在过去几天内,已经被接入了谷歌内部的编码平台Jetski中。
这可不是什么简单的修修补补,一位刚刚参与过测试的内部员工激动地对Business Insider表示:「在编程任务上,Carbon感觉简直就像是Opus 5.5!」
要知道,Opus 5.5可是目前Agentic Coding领域聚堆的天花板。
此前,有不少谷歌员工私下吐槽,早期的Argon版本在某些复杂代码任务上略显滞后,顶多也就是Claude Opus 5的水平。
甚至Gemini 4 Argon直接沦为测试背景板。
总之,Gemini 4跑分没输过,实测拉完了。
大V @Token Gremlin 用一个极具画面感的段子,无情地扒下了谷歌的底裤:
谷歌普通的一天:
员工 1:「老板,我们有比 Opus 5.5 更好的模型吗?」
员工 2:「就我测试的结果来看,没有。那些假基准测试说我们有,但差得远呢!」
劈柴哥:「要不我们就告诉大家它比 Opus 5.5 更好,但不让任何人测试?」
但Carbon的出现,直接把这个差距填平了!
员工们在内部Slack的聊天记录是这个画风——
「感觉这玩意儿完全可以媲美Opus 5.5了!」
「Carbon真的是出奇的强!」
「新的Gemini pro next模型手感太棒了!」
总之,谷歌内部正以疯狂的速度迭代Gemini 4系列。
甚至有内部文件显示,除了Argon和Carbon,他们还在测试一个叫「Barium(钡)」的模型。
看来,谷歌是跟元素周期表杠上了。
核心大招曝光!RSI究竟有多恐怖?
如此短的时间里,谷歌怎能让模型完成如此大的飞跃。
答案,就是RSI。
多位谷歌员工在爆料中不约而同地提到了这个词,将其视为当前Carbon取得重大进展的关键。
它允许AI在完成任务的过程中,自己发现代码中的错误,自己生成更优的解决方案,然后再把这些更聪明的逻辑内化成自己的能力。
每一次迭代,它都比上一次的自己更聪明;而它越聪明,它进化的速度就越快!
当一个Opus 5.5级编程能力的AI,24小时自我优化,迎来的将是指数级爆炸。
不过话说回来,实现RSI的貌似不止谷歌一家。
有业内人士分析指出,谷歌最近显然是理顺了内部的组织架构重组,开始集中火力猛攻技术痛点。
一位大V观察者在X写道:「我希望看到谷歌每个月都能发布一个明显强于竞争对手的检查点,这样我才会认同那个战无不胜的谷歌已经回归。」
而目前Carbon在内部测试中的炸裂表现,似乎正在证明:RSI已经在谷歌内部启动了。
是「真王者」还是「平庸之作」?
不过,虽然谷歌内部嗨翻了天,外界却表现出了冰火两重天的态度。
毕竟,谷歌在「发布前削弱模型」这件事上,有不少黑历史。
在X上,关于Carbon曝光的讨论已经两极化。
有乐观派如网友 @Haleeeemahh,直接甩出了之前大会上的基准测试截图,力挺谷歌:「Gemini 4 Argon其实已经击败了Opus 5.5!看来谷歌团队在上次活动中真的没有夸大其词。现在又来个和Opus 5.5不相上下的Carbon,你还觉得谷歌会沦为万年老二吗?」
但更多的人,则开启了无情嘲讽模式。
有技术大佬 @HistoryGPT 提出了灵魂质疑:「竞争对手发布顶级模型好几周后,你弄出一个内部测试版,刚好能和别人的模型打平……这真的能说明你们掌握了所谓的RSI吗?我不确定。」
而最让人痛心疾首的,是谷歌拖沓的官僚体制和令人迷惑的发布策略。
网友 @synthwavedd 的留言,说出了无数人的心声:「如果他们迟迟不把它交到公众手中,再加上谷歌那100%的『发布前削弱率』,等Argon真正能让大众用上的时候,绝对会沦为平庸之作。向谷歌的官僚体制致敬!」
毕竟,现在无论谷歌说什么,都没让开发者真正用上,模型一直留在内网里自嗨。
很多人想问,说好的尽快发布呢?
既然谷歌10月大会都开完了,不是说Argon要发给大众使用吗?为什么现在连个影子都没有?
在9月30日的公告中,谷歌表示会「尽快发布」,并没有给出任何具体的公测日期。因为Argon太危险了。
据官方透露,Argon在防御性网络安全方面有着前所未有的强大能力。它能够自主地发现系统漏洞、验证这些漏洞的致命性,甚至能够自己写代码去修复它们。
因此Argon如果不小心流到了黑客或者居心不良的人手里,那就是一场数字世界的灾难。
因此,谷歌采取了阶段发布策略家: 首先通过Fairwind Program,向一批受信任的网络安全防御者开放。在收集到足够的早期反馈,加上厚厚的「安全护栏」之后,才会进入下一步。
而且,最终公测时,第一批优先体验的也将是付费API客户和Google AI Ultra的订阅用户,有限给土豪用。
所以,普通大众现在根本连Argon的毛都摸不到。
正是这种为了安全而牺牲速度的「大厂包袱」,让谷歌在与狂奔的OpenAI和Anthropic的竞争中,总是显得慢半拍。
但至少,Carbon的曝光是一个强烈的信号:谷歌在Agent和复杂代码领域的弹药库,比我们想象的要充足得多。
目前,谷歌真正需要战胜的,或许不是Astra,也不是Opus 5.5,而是自己冗长的官僚制,和过度谨慎的发布策略。
参考资料:
https://www.businessinsider.com/google-employees-test-new-gemini-4-model-argon-barium-carbon-2026-10
本文来自微信公众号“新智元”(ID:AI_era),作者:ASI启示录,编辑:Aeneas 大卫,36氪经授权发布。















