据媒体报道,谷歌正式推出其最新大语言模型 Gemini 4 Argon。该模型专为软件工程、企业知识工作及网络安全等领域的长周期任务设计,旨在应对日益激烈的人工智能竞争。

目前,Gemini 4 Argon 正通过谷歌 Fairwind 项目,向少数“值得信赖的网络防御者”开放测试。谷歌计划随后向开发者、企业及消费者提供更广泛的访问权限。付费 API 客户和 Google AI Ultra 订阅用户将率先获得使用权,但官方尚未公布全面公开发布的具体日期。

性能跃升与定价策略

Gemini 4 Argon 的核心升级在于其上下文处理能力的显著扩展。其单次输出限制从此前的 6.4 万 Token 提升至 100 万 Token。谷歌表示,这一扩容使模型能够维持更长的推理轨迹,在单次运行中处理复杂的多步骤任务。

在定价方面,Gemini 4 Argon 的入门价格为每百万输入 Token 2 美元,每百万输出 Token 10 美元。若使用缓存输入 Token,标准输入费率可享受 95% 的折扣。

谷歌首席执行官桑达尔·皮查伊(Sundar Pichai)评价称,该模型在复杂工作流、网络防御和软件工程领域展现了前沿性能。内部团队已从编码到量子计算等多个场景广泛应用,反馈积极。数据显示,Argon 在衡量现实世界长周期软件工程任务的 DeepSWE v1.1 基准测试中,取得了 77.9% 的新纪录。

除代码生成外,Argon 还针对金融、法律研究及起草等知识密集型工作进行了优化。谷歌 DeepMind 测试表明,该模型在处理海量信息、科学问题解决及专业知识任务上表现强劲,其长上下文能力使其能在大量数据中精准识别并利用关键细节。此外,Argon 具备多模态能力,可分析图表、理解长视频并跨文档协作,以支持需要视觉与上下文综合理解的任务。

将网络安全置于核心

网络安全是 Gemini 4 Argon 的重点攻坚方向。该模型具备自主识别、验证及修补软件漏洞的能力。值得注意的是,对于初始用户和谷歌内部团队,该模型在未启用常规网络防护护栏的情况下即可运行,以满足高阶安全测试需求。

据悉,网络安全公司 Wiz 已通过其“Scan for Good”倡议试用 Argon。在早期演示中,Argon 成功发现了一处关键漏洞,该漏洞曾导致全球医院使用的医疗软件暴露敏感个人信息。

鉴于其强大的网络防御能力,谷歌采取了分阶段推广策略。公司正在强化防止滥用的安全措施,重点防范网络攻击、CBRN(化学、生物、放射性、核)相关威胁以及间接提示注入攻击。

巨头间的 AI 军备竞赛

此次发布正值谷歌、Anthropic 和 OpenAI 竞相部署更高性能、更具成本效益模型的白热化阶段。

今年早些时候,OpenAI 推出了号称“迄今为止最强大”的 GPT-6 Astra 模型。该模型支持从低到最高强度的推理努力,拥有 105 万 Token 的上下文窗口,最大输出量为 12.8 万 Token。

Anthropic 近期也发布了 Claude Opus 5.5,声称其在大多数任务上的表现与更高端的 Claude Fable 5.1 相当,而在典型工作负载下,运行成本较 Claude Opus 5 降低 40%。Claude Opus 5.5 定价为每百万输入 Token 4 美元,每百万输出 Token 20 美元,缓存读取成本降低 60%,主要面向代理式编码、计算机操作及知识工作场景。

与此同时,谷歌也在加速其全球 AI 布局。今年早些时候,谷歌选中 Terrastack、Varaha Climate、Farmers for Forests 和 Climitra Carbon 四家印度初创公司,加入首届谷歌 DeepMind 加速器“AI for the Planet (APAC)”项目。作为亚太区 16 支入选团队的一部分,这些公司将获得谷歌 AI 技术栈、技术支持及指导,致力于开发应对环境挑战的 AI 驱动解决方案。