谷歌发布Gemini 4 Argon,代码测试超Opus 5.5

AI 驱动中国 秦桑 1,002次阅读
分享 微 Q 信
AI摘要
由 AI 生成 · 仅供参考

谷歌发布Gemini 4 Argon,称其为迄今最先进AI模型,主打长流程软件工程、企业知识工作与网络安全防御,单次输出上限约100万tokens,DeepSWE得分77.9%高于Claude Opus 5.5与GPT-6 Astra,将分阶段开放。

驱动中国10月1日消息,谷歌于9月30日发布Gemini 4 Argon,称其为迄今最先进的AI模型,目前尚未面向公众全面开放。该模型重点面向长流程软件工程、企业知识工作和网络安全防御。

谷歌表示,Gemini 4 Argon在真实世界软件工程测试中创下纪录,在网络安全基准中并列第一,并在金融、法律等专业任务基准中处于领先位置。官方公布的DeepSWE v1.1测试结果显示,Gemini 4 Argon得分为77.9%,Claude Opus 5.5得分为74.2%,GPT-6 Astra得分为74.1%。

在模型能力方面,Gemini 4 Argon单次输出上限约为100万tokens,高于此前的64,000 tokens。谷歌称,这一参数规模适用于处理大型代码库、长文档和多阶段任务。谷歌DeepMind Gemini产品负责人Tulsee Doshi表示,Argon是一个功能全面的模型,在多个领域具备前沿能力。

在网络安全防御方面,谷歌称Gemini 4 Argon经过训练后能力超群,相较3.8 Flash Cyber有显著提升。在CWE-bench v1测试中,该测试用于评估模型修复安全漏洞的能力,Gemini 4 Argon以68%的得分并列第一。

在发布安排方面,谷歌表示将分阶段推出Gemini 4 Argon。第一阶段通过Fairwind Program向受信任的网络安全防御者提供,并参与美国政府的自愿预发布模型访问流程。在开放范围方面,谷歌计划先向付费API客户和Google AI Ultra用户开放,之后再扩大至企业和普通消费者。

谷歌同时称,Gemini 4 Argon在部分编码和知识工作基准测试中处于最先进水平,并在多个方面优于OpenAI的前沿模型GPT-6 Astra。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/524744.html
本文价值 ★★★★★ 4 2 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
✎ 我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友