编程体验接近Opus 5.5?谷歌Gemini 4新版本曝光

智东西
编译 | 杨京丽
编辑 | 李水青
智东西10月10日消息,今日,据外媒Business Insider报道,谷歌正在 内部测试Gemini 4的一个新版本 ,代号为 Carbon ,有望进一步缩小其与竞争对手在编程能力上的差距。
目前,Carbon已接入谷歌内部编程平台Jetski。部分员工认为,该模型的编程体验 与Claude Opus 5.5近似 ,但有员工强调,模型实际需要进行更多测试,才能作出更准确的判断。
谷歌已于10月1日发布Gemini 4 Argon ,重点面向 软件工程、企业知识工作、网络安全防御等场景 ,目前该模型尚未面向公众推出。
Carbon可能是Argon训练过程中的一个更新版本。谷歌内部文件显示,公司已测试了 Argon、Barium和Carbon等多个Gemini 4版本 。不过,内部代号与公开名称并不一一对应,例如,内部名为“Barium-B”的模型被选为对外以Argon之名推出的版本。
目前尚不清楚,Carbon会作为Argon的更新版推出,还是成为Gemini 4系列中的另一款模型。
一、Argon早期版本获积极评价,Carbon编程能力接近Opus 5.5
据Business Insider与谷歌员工的交流,以及该媒体看到的内部消息,Argon早期测试版本总体获得了员工的积极评价。
不过,一名员工认为,Argon的早期版本在部分编程任务上与前沿模型仍有差距,其体验更接近Anthropic较早推出的Claude Opus 5。
相比之下,最新更新的Carbon则获得了更高评价。一名员工告诉Business Insider,这个模型在编程方面“感觉像Opus 5.5”。不过,这名员工也补充说,需要进一步测试才能作出更准确的判断。
在Business Insider看到的内部消息频道中,也有员工写道:“感觉可以和Opus 5.5相比。”另一名员工则称:“Carbon真的很不错!”
还有员工评价:“新的Gemini Pro Next模型感觉不错。”其中,“Next”是谷歌内部通常用于标记Gemini新更新版本的标签。
这些反馈说明,谷歌内部对新版本的编程能力有较高期待,员工主观体验方面,Carbon在编程能力上提升明显。
二、Gemini 4存在多个版本,内部代号不等于公开名称
谷歌内部文件显示,该公司已测试了一系列Gemini 4模型,内部代号包括Argon、Barium和Carbon。
不过,内部代号与对外发布的名称并不一一对应。例如,一份文件提到,内部名为“Barium-B”的模型,被选为对外以Argon之名推出的版本。
目前,Business Insider尚无法确定,Carbon会成为Argon名下的又一次更新,还是Gemini 4系列中的另一款模型。谷歌对此拒绝置评。
谷歌发布Argon时称,Gemini 4 Argon在部分编程和知识工作基准测试中达到了前沿水平,涉及法律、金融等领域。谷歌还专门训练了Gemini 4 Argon的网络安全防御能力。
此外,谷歌还在拓展面向办公场景的Agent产品。昨天, 谷歌推出企业通用智能体Gemini Agent ,加入头部AI公司办公智能体竞争。
从升级旗舰模型到推出办公Agent,谷歌正加快追赶OpenAI、Anthropic等竞争对手,力求缩小在模型能力和应用等方面的差距。
结语:内部迭代提速,实际能力仍待公开检验
在Argon即将面向公众推出之际,谷歌内部已在测试Carbon等更多版本,员工对其编程能力给出了积极评价。不过,这些好评能否在公开版本中得到印证,还要看谷歌最终发布哪个版本,以及它在后续测试中的表现。
凭借处理复杂工程任务的能力,Anthropic和OpenAI的模型已赢得更多开发者的认可。谷歌要证明自己没有掉队,需要在加快模型迭代的同时,让开发者在实际使用中感受到模型能力的提升。
来源:Business Insider、谷歌
Les actualités sont collectées automatiquement depuis des flux publics robotique & IA.
Articles liés

Pourquoi la dextérité est le véritable goulot d’étranglement de l’IA physique
Le prochain défi majeur en matière de dextérité robotique consiste à rendre l’ensemble du système suffisamment fiable pour transformer ses capacités en travail utile. L'article Pourquoi la dextérité est le véritable goulot d'étranglement de l'IA physique apparaît en premier sur The Robot Report.

Agentic开发时代到来!鸿蒙PC三大原生开发工具公测,补齐国产操作系统生态关键短板
智东西 作者 | 程茜 编辑 | 漠影 当一台鸿蒙PC,既能跑鸿蒙应用,又能原生开发鸿蒙应用,会发生什么? 智东西10月10日报道,10月8日,可视化一站式IDE工具DevEco Studio、一站式鸿蒙应用AI开发工具DevEco Code与AI开发能力套件DevEco CLI,同步开启鸿蒙PC版公测。 三者分工明确:DevEco Studio主打集成开发、多端调试,承担基础IDE核心能力;DevEco Code提供端到端一站式Agentic开发体验;DevEco CLI对外输出鸿蒙开发能力,可无缝对接外部各类Agent工作流,让 AI 辅助开发融入鸿蒙 PC 原生环境。 DevEco三件套

2026中国计算机大会定了,12位院士演讲,腾讯阿里百度、小米京东都来了
智东西 作者 | 王涵 编辑 | 云鹏 智东西10月10日报道,今天,第二十三届中国计算机大会(CNCC2026)新闻发布会在京举行,智东西等媒体受邀参加。 据介绍,CNCC2026将于 10月21日至24日 在四川成都举办,主会场设于中国西部国际博览城和天府国际会议中心,大会主题为 “数聚驱动,智算未来” 。 本届大会共设 17场特邀报告、3场大会论坛、167个专题论坛及40余场专题活动 ,同期还将举办CCF计算机展览会。 其中,专题论坛演讲者有 789位 , 院士级演讲者有12位 ,来自腾讯、阿里、百度、小米、京东等企业专家达 92位 。 专题论坛围绕 11大主题 领域展开,包括:AI基础

00后硕士揭开AI推理“黑科技”:两个Token,基模追平强化学习版本
智东西 作者 | 杨京丽 编辑 | 李水青 智东西10月10日报道,一项来自麻省理工学院(MIT)等机构的研究发现, 只要固定基础模型回答开头的两个Token,就能让模型的数学推理成绩接近对应的强化学习版本 。 以艾伦人工智能研究所(Ai2)的基础模型Olmo-3-7B为例, 将回答固定为“.\n\nOkay”开头 后,模型在MATH-500上的 准确率从42%升至78% , 超过其强化学习版本的75% 。 这个过程没有修改模型参数,也没有给模型增加新的解题示例。模型只是换了一个回答起点,原本没有稳定表现出来的解题能力,似乎就更容易被调用出来。 换句话说,基础模型答错题,有时不一定是完全不会做

好产品就是与时代和生活共振|2026 年度极客最爱好物启动
一件好产品,往往是在用过一段时间之后,才让人意识到它的好。出门时顺手带上,遇到事情时首先打开,或者因为有了它,愿意尝试一件过去觉得麻烦的事。这样的产品,值得被分享给更多人。 2026 年,我们把寻找好产品的目光,投向更丰富的形态。能协助完成任务的 AI 应用、戴在身上的智能设备,以及尝试在真实环境中干活的机器人,都进入了今年的选品视野。技术提供了新的可能,具体的产品体验,决定了人们愿不愿意把它们带进生活。 我们关注产品解决了什么问题,也在意使用它要付出多少学习和操作成本。一款创作工具,可以让想法更容易实现;一件有趣的小设备,也可以只负责让人开心。我们同样欢迎那些在设计、手感或某个小细节上做得出

记录生生不息的创新力量|2026 年度「InnoForce 50」启动
过去几年,科技行业最重要的变化之一,是创新的底层逻辑正在被重新改写。 到了 2026 年,AI 已经不只是技术变量,而成为影响产品形态和组织方式的关键变量。它开始进入办公室、工厂、汽车、机器人、医院等场景,也进入了许多过去并不处在科技叙事中心的行业。它改变软件,也反过来改变硬件;改变一个人的工作方式,也改变一家公司的组织方式。 但 AI 不是全部。真正值得被记录的,是当 AI 成为新变量之后,整个创新世界被重新点燃了。 有人从 AI 出发,做出了过去不存在的产品;有人把 AI 带进传统行业,去解决那些卡了十年、二十年的老问题;有人重新思考人与机器的关系,让机器不只是工具,而是执行者,甚至某种意