← 返回信息流

热点The Decoder短讯

谷歌 Gemini 4 Carbon 模型据报编码能力匹敌 Anthropic Opus 5.5

the-decoder.com作者:Matthias Bastian模型AI评分:70/100

据 Business Insider 报道,谷歌内部一名员工表示,尚未广泛发布的 Gemini 4 “Carbon”版本在代码生成能力上已能匹配 Anthropic 的 Opus 5.5。与此同时,Gemini 应用和 AI Studio 中出现了新功能模式,暗示谷歌正为更广泛的 Gemini 4 发布做准备。

Image description
Image description

Gemini 4 “Argon”尚未正式发货,关于下一代性能升级的传闻就已经出现了。

据《商业内幕》(Business Insider)看到的文件、截图和内部聊天记录显示,谷歌正在测试几种名为 Argon、Barium 和 Carbon 的 Gemini 4 变体。Carbon 在过去几天里已部署在谷歌的内部编码平台 Jetski 上,据说主要在编程任务方面优于 Argon。

一名员工将 Carbon 与 Anthropic 最强的编码模型 Opus 5.5 相提并论,尽管它仍需更多测试。相比之下,早期的 Argon 版本让另一名员工在一些编码任务中想起了较旧的 Opus 5,尽管整体内部反馈是积极的。

Argon 是谷歌的前沿推理模型

早期的传闻将 Argon 定位为一款优化速度而非峰值性能的 Flash 模型。谷歌为 Google Workspace 推出的 Gemini 代理的发布消除了这一疑虑。谷歌将其模型映射到特定角色:“Argon 用于前沿推理,Flash 用于速度和吞吐量,Omni 用于生成式媒体,Gemma 用于轻量级、开放权重的边缘工作负载”,该公司写道。

因此,Argon 无疑是谷歌最强大的推理模型,可与 Anthropic 的 Opus 或 OpenAI 的 Astra 相媲美。Carbon 和 Barium 可能是 Argon 系列中的检查点或更新,而不是独立的层级。一名员工在内部称 Carbon 为“Gemini pro next model”,暗示它将作为 Argon 名称下的产品发布。这与内部文件显示现已公开的 Argon 此前被称为“Barium-B”相符。Carbon 是作为 Argon 的更新还是独立模型发布,目前尚不清楚。

这种快速的更新节奏,类似于谷歌对 Flash 模型所做的操作,表明谷歌在利用 AI 构建新模型方面变得更强了。Google DeepMind 员工 Vedant Misra 在 X 平台上回应《商业内幕》的报道时写道:“你听说过递归自我改进吗?”指的是利用 AI 来构建更好的 AI。OpenAI 和 Anthropic 也报告了类似的进展。

Google Deepmind employee Vedant Misra points to recursive self-improvement as a driver behind the rapid model iteration.
Google Deepmind employee Vedant Misra points to recursive self-improvement as a driver behind the rapid model iteration.

谷歌已开始准备 Gemini 4 的发布

目前还没有官方的 Gemini 4 发布日期,但谷歌已经在重新调整其应用程序。Gemini 应用现在为 3 系列模型显示了新的“自动”模式,以及可从低到高调整的推理强度。Google AI Studio 出现了一种新的“Ultra”模式,承诺提供“高级技能和工具”。谷歌的 Logan Kilpatrick 证实,团队正在努力充分发挥 Argon 的性能。

阅读原文