谁能料到,Gemini 4 Argon尚未面世,其下一代模型的传闻已先行曝光。
就在不久前,海外媒体报道称,谷歌Gemini 4的后续模型Carbon,已作为高度机密的“杀手锏”,悄然上线进行测试!
据透露,谷歌目前正在内部编码平台中评估一个代号为“Carbon”的新检查点。
新版模型的表现已接近Opus 5.5,多位员工表示,递归自我提升(RSI)是推动这一进步的核心因素。
参与内测的员工体验后纷纷感叹:“太震撼了!”
然而,近两个月来,OpenAI推出了Astra,Anthropic发布了Opus 5.5,谷歌何时才能推出一个真正可用的强大模型?
Argon尚未发布,Carbon抢先亮相!谷歌内部竞争白热化
今天,令人振奋的消息传来:谷歌最近在Antigravity中引入了对Gemini 4 Argon模型的引用,涵盖了低、中、高三种推理强度。
如今,Carbon也浮出水面,据称还有一个内部编码工具Jetsky。
用一个词来形容谷歌内部的现状,就是进展迅猛,内卷至极。
10月1日,谷歌Gemini 4 Argon发布,据称在网络安全、法律和金融等领域的基准测试中取得了突破性提升。
然而,直到今天,普通用户仍无法实际使用它。
就在外界质疑谷歌是否又在“PPT发布”时,一份泄露的内部文件和相关截图让围观者大吃一惊。
这些信息的真实性尚不确定。
如果Gemini 4 Argon真如图片所示,在多项基准测试中超越GPT-6 Astra和Opus 5.5,那么谷歌无疑将重回巅峰。
但在万众期待之下,Argon一再推迟发布。
原来,谷歌的工程师们根本无暇顾及Argon的公开上线时间,因为他们已沉迷于测试一个名为“Carbon”的新检查点,难以自拔!
据爆料,这个神秘的Carbon模型在过去几天内,已被接入谷歌内部的编码平台Jetski中。
这绝非简单的修补工作。一位刚参与测试的内部员工激动地向Business Insider表示:“在编程任务上,Carbon的体验简直堪比Opus 5.5!”
要知道,Opus 5.5目前是Agentic Coding领域的顶尖水平。
此前,不少谷歌员工私下吐槽,早期的Argon版本在某些复杂代码任务上表现欠佳,顶多达到Claude Opus 5的水平。
甚至Gemini 4 Argon直接沦为测试的参照物。
总之,Gemini 4在跑分上从未输过,但实际表现却令人失望。
大V @Token Gremlin 用一个生动的段子,无情地揭穿了谷歌的窘境:
谷歌普通的一天: 员工1:“老板,我们有比Opus 5.5更好的模型吗?” 员工2:“根据我的测试,没有。那些假基准测试说我们有,但实际差远了!” 劈柴哥:“要不我们就告诉大家它比Opus 5.5更好,但不让任何人测试?”
但Carbon的出现,直接弥补了这一差距!
员工们在内部Slack中的聊天记录是这样的——
“感觉这东西完全能与Opus 5.5媲美!” “Carbon真是出奇地强大!” “新的Gemini pro next模型手感极佳!”
总之,谷歌内部正以疯狂的速度迭代Gemini 4系列。
甚至有内部文件显示,除了Argon和Carbon,他们还在测试一个名为“Barium(钡)”的模型。
看来,谷歌是与元素周期表较上劲了。
核心大招曝光!RSI究竟有多可怕?
在如此短的时间内,谷歌如何让模型实现如此巨大的飞跃?
答案就是RSI。
多位谷歌员工在爆料中一致提到这个词,将其视为当前Carbon取得重大进展的关键。
它允许AI在完成任务的过程中,自行发现代码中的错误,生成更优的解决方案,并将这些更智能的逻辑内化为自身能力。
每一次迭代,它都比上一次的自己更聪明;而它越聪明,进化的速度就越快!
当一个具备Opus 5.5级编程能力的AI,进行24小时自我优化,将迎来指数级爆发。
不过,实现RSI的似乎并非只有谷歌一家。
有业内人士分析指出,谷歌最近显然已理顺内部组织架构重组,开始集中力量攻克技术难点。
一位大V观察者在X上写道:“我希望看到谷歌每个月都能发布一个明显优于竞争对手的检查点,这样我才会相信那个战无不胜的谷歌已经回归。”
而目前Carbon在内部测试中的惊艳表现,似乎正在证明:RSI已在谷歌内部启动。
是“真王者”还是“平庸之作”?
不过,尽管谷歌内部兴奋不已,外界却呈现出冰火两重天的态度。
毕竟,谷歌在“发布前削弱模型”方面有不少前科。
在X上,关于Carbon曝光的讨论已呈现两极化。
有乐观派如网友 @Haleeeemahh,直接引用之前大会上的基准测试截图,力挺谷歌:“Gemini 4 Argon其实已击败Opus 5.5!看来谷歌团队在上次活动中并未夸大其词。现在又来了个与Opus 5.5不相上下的Carbon,你还觉得谷歌会沦为万年老二吗?”
但更多人开启了无情嘲讽模式。
技术大佬 @HistoryGPT 提出了灵魂质疑:“竞争对手发布顶级模型数周后,你弄出一个内部测试版,刚好能与别人的模型打平……这真的能说明你们掌握了所谓的RSI吗?我不确定。”
而最令人痛心的,是谷歌拖沓的官僚体制和令人困惑的发布策略。
网友 @synthwavedd 的留言,道出了无数人的心声:“如果他们迟迟不把它交到公众手中,再加上谷歌那100%的‘发布前削弱率’,等Argon真正能让大众用上时,绝对会沦为平庸之作。向谷歌的官僚体制致敬!”
毕竟,无论谷歌现在说什么,都没让开发者真正用上,模型一直留在内网里自嗨。
很多人想问,说好的尽快发布呢?
既然谷歌10月大会已结束,不是说Argon要发给大众使用吗?为什么现在连个影子都没有?
在9月30日的公告中,谷歌表示会“尽快发布”,并未给出任何具体的公测日期。因为Argon太危险了。
据官方透露,Argon在防御性网络安全方面拥有前所未有的强大能力。它能自主发现系统漏洞、验证这些漏洞的致命性,甚至能自己写代码修复它们。
因此,如果Argon不慎落入黑客或居心不良者手中,将是一场数字世界的灾难。
因此,谷歌采取了分阶段发布策略:首先通过Fairwind Program,向一批受信任的网络安全防御者开放。在收集到足够的早期反馈,加上厚厚的“安全护栏”之后,才会进入下一步。
而且,最终公测时,第一批优先体验的也将是付费API客户和Google AI Ultra的订阅用户,优先给土豪使用。
所以,普通大众现在根本连Argon的边都摸不到。
正是这种为了安全而牺牲速度的“大厂包袱”,让谷歌在与狂奔的OpenAI和Anthropic的竞争中,总是显得慢半拍。
但至少,Carbon的曝光是一个强烈的信号:谷歌在Agent和复杂代码领域的储备,比我们想象的要充足得多。
目前,谷歌真正需要战胜的,或许不是Astra,也不是Opus 5.5,而是自身冗长的官僚体制和过度谨慎的发布策略。
参考资料:
https://www.businessinsider.com/google-employees-test-new-gemini-4-model-argon-barium-carbon-2026-10
本文来自微信公众号“新智元”(ID:AI_era),作者:ASI启示录,编辑:Aeneas 大卫,36氪经授权发布。