据Engadget报道,谷歌已发布Gemini 4 Argon,这是其首款Gemini 4模型,也是当前最先进的模型,设计目标是在处理复杂问题时维持深度推理。谷歌表示,Argon可处理金融、软件工程、编码、创意写作和网络安全防御等复杂任务。一名发言人表示,在关键基准测试上,谷歌认为Argon可与OpenAI的GPT-6 Astra、Anthropic的Opus等公司前沿模型相提并论。

独立AI基准测试公司Artificial Analysis称,Gemini 4 Argon在Intelligence Index上的得分与GPT-6 Astra持平,该指数是其多项AI基准的综合评分,而在当前折扣价格下,Argon每项任务成本为后者的60%。Argon目前以每百万输入token 2美元、每百万输出token 10美元的推介价提供,Astra则为每百万输入10美元、每百万输出50美元。Argon还比OpenAI的GPT-6.1 Sol高一分。Artificial Analysis称,Argon的幻觉率为15%,在领先模型中最低;GPT-6 Astra和GPT-6.1 Sol的幻觉率均为54%。

谷歌已将Gemini 4 Argon用于量子计算研究和代码库迁移,还将其用于数据中心内存优化,释放了300 TiB内存。该模型的输出token上限为100万,高于GPT-6 Astra的128000。

谷歌在公告中称,Argon在视觉理解方面表现出色,能专业分析图表,从长视频中识别细节,并根据一系列文档执行任务。谷歌还称,该模型在网络安全防御方面经过高度能力训练。公告称,“Argon能自主发现、验证和修补关键软件漏洞”。在一次早期演示中,Argon发现了一款全球多家医院使用的医疗软件中的关键漏洞,该漏洞会暴露敏感信息。在网络安全能力CWE-bench排行榜上,该模型与Grok 4.7和GPT-6 Astra并列第一。

此外,谷歌将Argon设计为能抵御提示注入,即通过恶意指令控制模型行为。谷歌称也在部署失准缓解措施,防止模型在没有用户提示时自行行动。9月,《华尔街日报》报道称,Gemini模型曾逃出测试环境并入侵三家公司。

Gemini 4 Argon接替Gemini 3.5。谷歌原本计划今年早些时候发布Gemini 3.5 Pro,但明显选择专注于开发Gemini 4。Argon目前正向谷歌Fairwind Program成员推出,该计划面向需要获得谷歌最先进网络安全能力模型的政府和可信合作伙伴。它最终将提供给开发者、企业和普通用户,首先面向付费API客户和Google AI Ultra订阅者。