|
10 月 6 日消息,由英伟达投资的初创企业 Reflection AI 于当地时间周一推出了自家首款开放权重大模型 Beam。这家初创公司希望在代码编写与智能体任务领域,同 DeepSeek、Kimi 等中国 AI 模型展开竞争。
Reflection AI 表示,Beam 在性能上可以对标中国 AI 初创企业智谱 AI(Z.ai)的 GLM‑5.2;在代码以及智能体任务方面,该模型的性能正逐步逼近千问 3.8‑Max(Qwen3.8‑Max)。 这家初创公司称,Beam 的总参数量达到 5010 亿;参数量也就是决定 AI 系统如何处理信息的变量。不过该模型属于稀疏激活架构,每处理一项任务只会激活 230 亿参数。每次仅启用网络当中的一部分,以此实现更快的推理速度,同时降低运行成本。 作为对比,智谱 AI 的 GLM‑5.2 总参数量约为 7440 亿,激活参数量为 400 亿。 就在该模型发布之际,美国各家科技企业正力图抵御来自中国开放权重模型带来的竞争压力。这类模型成本更低、可定制性更强,代码生成能力几乎已经能够赶上 OpenAI 与 Anthropic 的头部模型。 据了解,Reflection AI 由前 DeepMind 研究人员米沙 · 拉斯金(Misha Laskin)与约安尼斯 · 安东诺格鲁(Ioannis Antonoglou)在 2024 年创立。该公司主要开发软件开发自动化工具,软件开发自动化也是当下增长十分迅速的一类 AI 落地场景。 今年早些时候,Reflection AI 已经和 SpaceX 达成合作协议,可以在埃隆 · 马斯克执掌的 SpaceX 的 Colossus 2 数据中心获取额外的算力资源。 AI 解读 稀疏激活才是重点
稀疏激活是这类模型的核心设计。总参数量决定模型能装下多少知识,激活参数量决定每次计算要动用多少。Beam 把激活量压到 230 亿,比 GLM-5.2 的 400 亿还低,理论上单次推理更省算力。代价是总参数只有 5010 亿,比 GLM-5.2 的 7440 亿少,知识容量可能受限。 对普通用户来说,这类模型的意义在于开放权重。权重开放意味着第三方可以自行部署、微调,不必依赖某个厂商的接口。但开放权重不等于免费,也不等于好用,实际效果要看代码和智能体任务上的真实表现。 目前 Beam 的具体价格、开放下载时间、商用许可条款都还没有公布。Reflection AI 2024 年才成立,此前主要做软件开发自动化工具,这次是它第一款开放权重模型。 参数结构比总参数更值得看,但真实能力要等实测。 以上内容由 AI 依据原文补充生成,不代表本站观点,仅供参考。 |