美国AI新势力崛起:Reflection能否重塑开放模型格局
2026-10-08 08:06:05未知 作者:徽声在线
出品|徽声在线科技组
作者|黄天媛(改写)
编辑|苗正卿(修订)
头图|Reflection AI官网(更新)
历经两年研发,立志打造"美国版DeepSeek"的Reflection AI终于亮出成果。
美国当地时间10月5日,Reflection AI正式发布首款开放权重模型Beam,该模型专注于编程、逻辑推理及智能体任务开发。(徽声在线注:开放权重模型指公开预训练参数供开发者自由部署,具体修改权限与商业使用规则需遵循许可证协议)
此举引发美国科技界广泛关注,多家主流媒体将Beam视为美国在开放AI领域对中国技术的回应。
Reflection AI高层在发布会现场明确表示,该模型直接对标中国顶尖AI产品。
根据技术白皮书披露,Beam在编程任务和智能体应用场景中已具备与智谱GLM 5.2竞争的实力,接近阿里巴巴Qwen 3.8-Max水平,但在综合性能上仍与Kimi K3等头部模型存在差距。
然而技术参数并非Beam的核心价值所在。
Reflection AI的差异化战略清晰可见:专注服务那些因政策限制或数据主权考量,无法采用中国AI解决方案,同时又渴望掌握AI技术自主权的企业与政府机构。
在美国本土AI生态中,同时具备数十亿美元级融资能力、顶级GPU算力集群、英伟达战略支持,以及政府级AI项目资源的初创企业实属罕见。
这种独特定位,使得尚未跻身开放模型第一梯队的Beam仍获得资本市场高度关注。
Reflection AI究竟是家怎样的企业?Beam模型的技术突破体现在哪些方面?
Beam技术解析报告
Reflection创始人团队在技术分享会上透露,Beam采用混合专家模型(MoE)架构,总参数规模达5000亿级,但实际推理时仅激活约230亿参数。
横向对比显示:DeepSeek-V3参数总量6710亿/激活370亿;月之暗面Kimi K2参数总量1万亿/激活320亿;智谱GLM-4.5参数总量3550亿/激活320亿。Beam在参数效率优化方面展现出独特优势。
研发团队特别强调,Beam从预训练到微调全程自主完成,未采用任何模型蒸馏技术,并针对代码生成、逻辑推理和智能体交互三大场景进行专项强化训练。
在推理效率优化方面,Beam实现重大突破。
通过大规模强化学习框架,该模型处理同等复杂度任务时,所需Token消耗量和计算资源仅为GLM 5.3、GPT-6 Luna等模型的25%-33%。
官方数据显示,Beam预训练阶段处理了23.8万亿Token数据,显著超过DeepSeek-V3的14.8万亿和Kimi K2的15.5万亿。在强化学习阶段,系统调用10500张英伟达GB300 GPU持续运算4周,生成超1亿次决策轨迹(Rollout)。
Reflection AI提出重要技术判断:大模型发展进入新阶段。
传统通过扩大参数量和训练数据提升性能的模式已趋成熟,未来模型能力跃升的关键将在于强化学习框架的规模化应用。
从这个角度看,Beam更像是Reflection AI的技术实验田。
这家新锐企业试图验证:通过大规模强化学习,能否用较少激活参数实现接近中国头部开放模型的实际效果。
目前来看,Beam已成功获得行业入场券。
Reflection AI的崛起之路
Reflection AI的创业历程充满戏剧性。
这家成立于2024年的企业,由前Google DeepMind核心成员Misha Laskin和Ioannis Antonoglou联合创立。两位创始人在DeepMind期间深度参与Gemini系列开发,其中Antonoglou更是AlphaGo项目元老级成员。
据Laskin在行业峰会披露,公司创立初期本计划采取"模型轻量化"战略:专注强化学习与智能体技术研发,而非直接参与基础模型竞争。
当时的技术判断认为:强化学习将推动大模型从对话交互向编程实现和自主决策演进;同时西方开放模型生态将持续完善,Reflection无需重复造轮子。
然而技术演进超出预期,强化学习确实成为主流方向,但西方开放模型发展却显著滞后于中国。
DeepSeek V3的发布造成技术代差,Reflection等待数月未见美国同类产品出现,最终被迫调整战略方向。
Beam模型的推出,标志着这家企业完成从技术服务商到基础模型提供商的转型。
当前全球AI格局呈现明显分化:美国企业仍主导闭源模型市场,但开放模型领域正被中国力量重塑。
OpenRouter最新排名显示,在开发者最常用的开放模型中,DeepSeek、智谱、小米、腾讯等中国企业的产品占据主导地位。
这种技术格局变化,正是Reflection AI获得美国政府重点扶持的核心原因。
资本市场对Reflection的估值已达250亿美元,累计融资超40亿美元,其中英伟达战略投资8亿美元。
今年7月,路透社报道该公司与云计算服务商Nebius签署价值超10亿美元的算力供应协议,确保获得英伟达最新芯片的稳定供给。
此前,Reflection已与SpaceX达成长期算力合作,据Axios披露,自2024年7月起每月支付1.5亿美元,协议有效期至2029年。
公司官网还宣布,将参与美国能源部Genesis Mission科研计划,为国家级实验室提供开放模型支持。
对于一家成立仅两年、首款基础模型刚发布的企业而言,这种资源获取能力堪称罕见。
投资者真正看重的显然不止Beam模型本身。
他们押注的是美国重建开放模型生态系统的战略机遇。
根据Reflection的商业规划,开放权重只是起点。其完整解决方案包括:模型架构授权、推理引擎优化、开发工具链、基础设施部署,以及企业级私有化定制服务。
目标客户群体明确指向大型企业、政府机构、公共部门及"主权AI"需求方。
这种战略定位已在国际市场取得突破。
今年3月,Reflection与韩国新世界集团签署战略合作协议,计划投资建设250MW规模的AI数据中心,为韩国政企客户提供主权AI服务。项目采用Reflection开放模型与英伟达GPU架构,美国商务部长亲自出席签约仪式并表态支持。
尽管Reflection已获得关键资源与早期客户,但Beam模型仍需跨越两道门槛:构建繁荣的开发者生态,以及持续提升模型性能。
这些挑战,不是资本投入或合作名单所能直接解决的。
本内容经作者独家授权发布,观点仅代表作者个人立场,与徽声在线无关。如对稿件内容存疑或需投诉,请联系[email protected]。
本文源自徽声在线,原文链接:https://www.huxiu.com/article/4895638.html?f=wyxwapp(更新)

