成立仅两年的初创公司 Reflection AI 正式发布其首款前沿开源模型 Beam。该公司声称,Beam 在高级推理基准测试中的表现可与领先的中文开源模型相媲美,且成本大幅降低,此举可能加剧西方阵营对标 DeepSeek、Qwen 和 Z.ai 模型的竞争热度。

据媒体报道,Beam 是一个纯文本混合专家(MoE)模型,经过高算力强化学习训练,擅长推理、编码和智能体任务。官方数据显示,其“令牌成本和推理时间计算量”仅为竞争对手的“一小部分”。该模型拥有 5010 亿总参数,其中活跃参数为 230 亿,使用 23.8 万亿个令牌进行预训练,上下文窗口达 100 万令牌。相比之下,Z.ai 的 GLM 5.2 总参数约为 7440 亿,活跃参数为 400 亿。

性能对标与市场竞争

尽管独立验证尚缺,但 Reflection 表示,Beam 在高级推理基准测试中与 Z.ai 的 GLM-5.2 持平,并优于目前领先的西方开源模型,同时所需的“推理计算资源减少了 3-4 倍”。公司将 Beam 定位为面向企业、公共部门和开发人员的“主力模型”。

Reflection 的直接竞争对手包括 Anthropic、OpenAI 等封闭实验室,以及 Mistral、Meta、Cohere 等西方开源玩家。在美国市场,其最直接的竞品可能是 Mira Murati 旗下 Thinking Machines Lab 于今年 7 月发布的开源模型 Inkling。Reflection 的基准测试显示,Beam 在四项编码测试中得分高于 Inkling,但需注意 Inkling 为多模态模型,而 Beam 仅支持文本。

资本加持与算力布局

Reflection 由两名前 Google DeepMind 研究人员于 2024 年创立。据 PitchBook 数据,公司已从英伟达、红杉资本和 Lightspeed Venture Partners 等处筹集约 47 亿美元,上一轮融资投前估值达 250 亿美元。

为确保训练前沿模型所需的算力,并吸引客户远离封闭模型及中国低价开源模型,Reflection 今年夏天与 SpaceX 和 Nebius 签署了总额超过 70 亿美元的协议,锁定至 2029 年的英伟达 GB300 芯片使用权。

主打“AI工厂”概念

Reflection 计划将 Beam 及未来模型主要面向企业和主权国家客户,重点推广“AI工厂”概念。该产品允许机构利用自身专有数据训练模型,构建定制化本地 AI 系统。这一理念得到支持者英伟达及其 CEO 黄仁勋的大力倡导,旨在加强开放 AI 生态系统,进而带动 GPU 需求。

据悉,对冲基金和交易公司是此类系统的潜在用户。目前,Reflection 已开始与韩国新世界集团(Shinsegae Group)测试主权 AI 工厂合作概念。

Reflection 表示,将在本月发布 Beam 的权重和完整技术细节,并通过超大规模云厂商及新云服务商进行分发,同时整合至各个开源库中。