爱看AI
返回列表
最新资讯国内industry

编程体验接近Opus 5.5?谷歌Gemini 4新版本曝光

来源智东西(zhidx.com)8小时前 · 2026/10/10
编程体验接近Opus 5.5?谷歌Gemini 4新版本曝光

智东西

编译 | 杨京丽

编辑 | 李水青

智东西10月10日消息,今日,据外媒Business Insider报道,谷歌正在 内部测试Gemini 4的一个新版本 ,代号为 Carbon ,有望进一步缩小其与竞争对手在编程能力上的差距。

目前,Carbon已接入谷歌内部编程平台Jetski。部分员工认为,该模型的编程体验 与Claude Opus 5.5近似 ,但有员工强调,模型实际需要进行更多测试,才能作出更准确的判断。

谷歌已于10月1日发布Gemini 4 Argon ,重点面向 软件工程、企业知识工作、网络安全防御等场景 ,目前该模型尚未面向公众推出。

Carbon可能是Argon训练过程中的一个更新版本。谷歌内部文件显示,公司已测试了 Argon、Barium和Carbon等多个Gemini 4版本 。不过,内部代号与公开名称并不一一对应,例如,内部名为“Barium-B”的模型被选为对外以Argon之名推出的版本。

目前尚不清楚,Carbon会作为Argon的更新版推出,还是成为Gemini 4系列中的另一款模型。

一、Argon早期版本获积极评价,Carbon编程能力接近Opus 5.5

据Business Insider与谷歌员工的交流,以及该媒体看到的内部消息,Argon早期测试版本总体获得了员工的积极评价。

不过,一名员工认为,Argon的早期版本在部分编程任务上与前沿模型仍有差距,其体验更接近Anthropic较早推出的Claude Opus 5。

相比之下,最新更新的Carbon则获得了更高评价。一名员工告诉Business Insider,这个模型在编程方面“感觉像Opus 5.5”。不过,这名员工也补充说,需要进一步测试才能作出更准确的判断。

在Business Insider看到的内部消息频道中,也有员工写道:“感觉可以和Opus 5.5相比。”另一名员工则称:“Carbon真的很不错!”

还有员工评价:“新的Gemini Pro Next模型感觉不错。”其中,“Next”是谷歌内部通常用于标记Gemini新更新版本的标签。

这些反馈说明,谷歌内部对新版本的编程能力有较高期待,员工主观体验方面,Carbon在编程能力上提升明显。

二、Gemini 4存在多个版本,内部代号不等于公开名称

谷歌内部文件显示,该公司已测试了一系列Gemini 4模型,内部代号包括Argon、Barium和Carbon。

不过,内部代号与对外发布的名称并不一一对应。例如,一份文件提到,内部名为“Barium-B”的模型,被选为对外以Argon之名推出的版本。

目前,Business Insider尚无法确定,Carbon会成为Argon名下的又一次更新,还是Gemini 4系列中的另一款模型。谷歌对此拒绝置评。

谷歌发布Argon时称,Gemini 4 Argon在部分编程和知识工作基准测试中达到了前沿水平,涉及法律、金融等领域。谷歌还专门训练了Gemini 4 Argon的网络安全防御能力。

此外,谷歌还在拓展面向办公场景的Agent产品。昨天, 谷歌推出企业通用智能体Gemini Agent ,加入头部AI公司办公智能体竞争。

从升级旗舰模型到推出办公Agent,谷歌正加快追赶OpenAI、Anthropic等竞争对手,力求缩小在模型能力和应用等方面的差距。

结语:内部迭代提速,实际能力仍待公开检验

在Argon即将面向公众推出之际,谷歌内部已在测试Carbon等更多版本,员工对其编程能力给出了积极评价。不过,这些好评能否在公开版本中得到印证,还要看谷歌最终发布哪个版本,以及它在后续测试中的表现。

凭借处理复杂工程任务的能力,Anthropic和OpenAI的模型已赢得更多开发者的认可。谷歌要证明自己没有掉队,需要在加快模型迭代的同时,让开发者在实际使用中感受到模型能力的提升。

来源:Business Insider、谷歌

资讯由采集器定时从公开的机器人 / AI 信息源自动聚合。

相关内容

国外industry自动翻译

为什么灵活性是物理人工智能的真正瓶颈

机器人灵活性的下一个主要挑战是使整个系统足够可靠,以将功能转化为有用的工作。 《为什么灵活性是物理人工智能的真正瓶颈》一文首先出现在《机器人报告》上。

来源Robotics Business Review7小时前
国内industry

Agentic开发时代到来!鸿蒙PC三大原生开发工具公测,补齐国产操作系统生态关键短板

智东西 作者 | 程茜 编辑 | 漠影 当一台鸿蒙PC,既能跑鸿蒙应用,又能原生开发鸿蒙应用,会发生什么? 智东西10月10日报道,10月8日,可视化一站式IDE工具DevEco Studio、一站式鸿蒙应用AI开发工具DevEco Code与AI开发能力套件DevEco CLI,同步开启鸿蒙PC版公测。 三者分工明确:DevEco Studio主打集成开发、多端调试,承担基础IDE核心能力;DevEco Code提供端到端一站式Agentic开发体验;DevEco CLI对外输出鸿蒙开发能力,可无缝对接外部各类Agent工作流,让 AI 辅助开发融入鸿蒙 PC 原生环境。 DevEco三件套

来源智东西8小时前
国内industry

2026中国计算机大会定了,12位院士演讲,腾讯阿里百度、小米京东都来了

智东西 作者 | 王涵 编辑 | 云鹏 智东西10月10日报道,今天,第二十三届中国计算机大会(CNCC2026)新闻发布会在京举行,智东西等媒体受邀参加。 据介绍,CNCC2026将于 10月21日至24日 在四川成都举办,主会场设于中国西部国际博览城和天府国际会议中心,大会主题为 “数聚驱动,智算未来” 。 本届大会共设 17场特邀报告、3场大会论坛、167个专题论坛及40余场专题活动 ,同期还将举办CCF计算机展览会。 其中,专题论坛演讲者有 789位 , 院士级演讲者有12位 ,来自腾讯、阿里、百度、小米、京东等企业专家达 92位 。 专题论坛围绕 11大主题 领域展开,包括:AI基础

来源智东西12小时前
国内industry

00后硕士揭开AI推理“黑科技”:两个Token,基模追平强化学习版本

智东西 作者 | 杨京丽 编辑 | 李水青 智东西10月10日报道,一项来自麻省理工学院(MIT)等机构的研究发现, 只要固定基础模型回答开头的两个Token,就能让模型的数学推理成绩接近对应的强化学习版本 。 以艾伦人工智能研究所(Ai2)的基础模型Olmo-3-7B为例, 将回答固定为“.\n\nOkay”开头 后,模型在MATH-500上的 准确率从42%升至78% , 超过其强化学习版本的75% 。 这个过程没有修改模型参数,也没有给模型增加新的解题示例。模型只是换了一个回答起点,原本没有稳定表现出来的解题能力,似乎就更容易被调用出来。 换句话说,基础模型答错题,有时不一定是完全不会做

来源智东西13小时前
国内industry

好产品就是与时代和生活共振|2026 年度极客最爱好物启动

一件好产品,往往是在用过一段时间之后,才让人意识到它的好。出门时顺手带上,遇到事情时首先打开,或者因为有了它,愿意尝试一件过去觉得麻烦的事。这样的产品,值得被分享给更多人。 2026 年,我们把寻找好产品的目光,投向更丰富的形态。能协助完成任务的 AI 应用、戴在身上的智能设备,以及尝试在真实环境中干活的机器人,都进入了今年的选品视野。技术提供了新的可能,具体的产品体验,决定了人们愿不愿意把它们带进生活。 我们关注产品解决了什么问题,也在意使用它要付出多少学习和操作成本。一款创作工具,可以让想法更容易实现;一件有趣的小设备,也可以只负责让人开心。我们同样欢迎那些在设计、手感或某个小细节上做得出

来源极客公园13小时前
国内industry

记录生生不息的创新力量|2026 年度「InnoForce 50」启动

过去几年,科技行业最重要的变化之一,是创新的底层逻辑正在被重新改写。 到了 2026 年,AI 已经不只是技术变量,而成为影响产品形态和组织方式的关键变量。它开始进入办公室、工厂、汽车、机器人、医院等场景,也进入了许多过去并不处在科技叙事中心的行业。它改变软件,也反过来改变硬件;改变一个人的工作方式,也改变一家公司的组织方式。 但 AI 不是全部。真正值得被记录的,是当 AI 成为新变量之后,整个创新世界被重新点燃了。 有人从 AI 出发,做出了过去不存在的产品;有人把 AI 带进传统行业,去解决那些卡了十年、二十年的老问题;有人重新思考人与机器的关系,让机器不只是工具,而是执行者,甚至某种意

来源极客公园14小时前