
谷歌最具野心的AI模型Gemini 4已取得关键进展。据媒体报道,Google DeepMind高级副总裁Koray Kavukcuoglu近日透露,Gemini 4目前已进入早期后训练阶段,并预计将在年底前“更早”面世。这是谷歌高管迄今为止就该项目发布时间表给出的最明确信号。
高层定调:最具雄心的预训练
Kavukcuoglu在今年8月接任Google DeepMind日常运营负责人后,首次公开分享了这一进展。他表示,模型正处于公开发布前的优化阶段,旨在确保性能可靠与安全。此前,Alphabet CEO Sundar Pichai已在财报电话会议上将Gemini 4定义为公司“迄今为止最具雄心的预训练运行”,并对内部测试进展表示兴奋,认为其将满足外界期待。
尽管旗舰模型研发面临挑战,谷歌并未停滞。今年以来,谷歌密集迭代3.x系列模型,几乎每月推出针对代理编码、实时语音及网络安全的Flash变体。然而,原定于6月发布的Gemini 3.5 Pro推迟至夏季才进入合作伙伴测试,Gemini 4的全面训练直至7月才真正展开。
竞争加剧与内部权力交接
当前AI竞争格局日益拥挤,OpenAI、Anthropic及Meta等竞争对手接连发布强力模型,市场迫切期待谷歌的下一代旗舰产品。Kavukcuoglu的表态被视为谷歌回应竞争压力的重要举措。这位AI资深人士自2012年加入DeepMind以来,深度参与了多项突破性技术研发。随着他接管模型开发及前沿研究,创始人Demis Hassabis转而担任Alphabet首席科学家的战略顾问,标志着DeepMind内部执行层面权力的平稳过渡。
业界猜测,谷歌可能调整发布节奏以避免被竞品 overshadowed。虽有传言称LMSYS Arena上出现的异常表现可能暗示早期版本泄露,但谷歌未予置评。可以确定的是,谷歌正试图加快迭代速度:轻量级模型保持月度更新,而大型前沿模型则作为核心基石,每六到九个月实现一次重大飞跃。
技术展望与市场影响
Gemini 4的具体架构仍属机密,但行业估计其预训练成本高达数千万甚至数亿美元。该模型有望在智能体能力、多模态理解(视频、音频、代码)及长周期任务处理上实现显著增强,并将深度整合至Search、YouTube、Android及Google Cloud生态中。对于企业用户和开发者而言,这意味着更强大的基础设施支持。
timing的选择也颇具深意。在Alphabet股价受市场波动影响的背景下,年底前发布重磅新品有助于安抚投资者情绪。Kavukcuoglu语气审慎,未过度炒作,但“比12月早得多”的表述为秋季部署留下了想象空间。随着终点线临近,谷歌正通过规模优势、数据壁垒及紧密的产品整合,试图重新夺回AI领域的叙事主动权。