谷歌正式推出Gemini 4 Argon,此举标志着其在暂缓发布Gemini 3.5 Pro并陆续迭代Flash模型后,再次向前沿AI领域发起冲击。官方声称,新模型在编程、知识工作及网络安全方面具备行业领先性能,但目前尚未向普通用户开放。

内部广泛启用,助力代码迁移与能效优化

尽管公众仍需等待,谷歌内部工程师已率先大规模部署Gemini 4 Argon。据悉,该模型通过分析“全车队遥测数据”,帮助谷歌数据中心节省了300 TiB内存。在代码重构方面,Argon智能体正协助将C/C++代码库迁移至Rust语言,涉及核心库re2和libgav1的数千行代码,以及Fuchsia OS Zircon内核中超过80万行代码。

基准测试表现亮眼,多项指标超越竞品

为佐证其性能主张,谷歌公布了一系列基准测试数据。在软件工程基准测试DeepSWE v1.1中,Gemini 4 Argon得分77.9%,优于GPT-6 Astra、Fable 5.1及Opus 5.5。此外,谷歌指出,Argon在长周期任务中表现强劲,并在经济分析Vals Index测试中取得行业领先分数。