
当前旗舰AI模型多由前沿实验室掌控且以闭源为主,法国人工智能实验室Mistral正试图打破这一格局。
Mistral正式推出其新旗舰模型Mistral Large 4(ML4,代号“le Chonk”)的公开预览版。这是一款拥有万亿参数规模的开放权重模型,旨在提供通用智能体能力。Mistral声称,该模型性能可与顶级闭源模型媲美,并在与自身规模大三倍的开放权重模型竞争中保持优势。此外,该模型在约4,000块NVIDIA Grace Blackwell GPU上完成训练,成本仅为竞争对手的一小部分。
聚焦网络安全与企业自主权
此次发布突显了Mistral在网络安全领域的布局。公司表示,ML4在进攻性和防御性网络安全类别中表现强劲。Mistral联合创始人兼首席科学家Guillaume Lample指出,开放权重特性允许企业在无需担心模型突然被弃用或服务中断的情况下,安全构建和部署网络安全防御体系。
Lample强调:“新的网络安全工作流需要大量token和处理推理能力,企业无法承受因保护模型消失或功能受限带来的脆弱性风险。”
除网络安全外,新模型在编码、领域专业知识及多模态任务中也表现出色。官方博客显示,该模型基于强化学习训练,团队已取得快速进展。这与主要依赖蒸馏技术的其他开放权重模型形成对比,Mistral借此强调其自主研发、训练基础设施及专业能力。目前,该模型已部署于Mistral欧洲数据中心并通过该基础设施提供服务预览。
部署策略与发布时间
鉴于万亿参数的庞大体量,ML4无法在个人电脑或笔记本电脑上本地运行,对部分高校而言自行托管亦不切实际。该模型主要面向希望在本地服务器或私有云内部署的企业用户,同时也将通过Mistral API提供服务。模型权重定于10月27日正式发布。
行业观察
开放权重模型在AI行业中扮演关键角色,赋予企业和用户对模型及其使用方式的控制权。权重公开使得用户能够自行检查、测试和运行模型,并在部署后持有完整副本,从而避免依赖提供商的维护决策。由于模型版本间行为存在差异,强制迁移可能导致基于旧模型构建的系统崩溃,因此开发能与领先闭源模型抗衡的开放权重模型至关重要。目前,开放权重生态系统主要由中国前沿实验室推动,行业普遍欢迎Mistral等提供商带来的替代方案。