Kimi K3风暴第四日:月之暗面黄震昕直面争议,中国开源大模型定价权突围战打响
2026-07-25 16:24:06未知 作者:徽声在线
Kimi K3发布后的第四天,市场热度依旧不减,争议与赞誉并存。
就在四天前,即7月17日凌晨,一款拥有2.8万亿参数的K3模型横空出世,凭借1679分的高分成功登顶Frontend Code Arena榜单,成为首个在该前端编程榜单上超越众多闭源模型的开源模型。特斯拉CEO埃隆·马斯克在相关评测下留言称赞:“Impressive(令人印象深刻)。”这已是马斯克今年3月点赞Kimi底层架构技术报告后,第二次公开认可这支来自中国的团队。甚至在预告新模型Grok 4.6时,马斯克也将Kimi K3作为对比目标,足见其影响力。
然而,赞誉的背后也伴随着风暴。发布仅48小时后,Kimi官方发文表示,用户请求量已远超预期,逼近现有集群的承载极限,因此决定暂停C端新用户订阅。这一举措被业内人士类比为“DeepSeek 2.0时刻”,引发了广泛关注。
与此同时,质疑声也不绝于耳。一方面,外界流传着K3是蒸馏模型的言论;另一方面,人工智能公司OpenAI战略未来负责人迪恩·鲍尔也公开发帖抨击Kimi K3模型。他承认K3的性能无法仅通过蒸馏实现,但同时表示开放权重模型会削弱前沿模型的商业回报,称其为“减速主义力量”。
面对技术原创性争议、开源闭源路线之辩以及高定价策略的可持续性等三重追问,月之暗面公司企业业务负责人黄震昕直面媒体,首次系统性地回应了外界质疑。
“性能跃升源于底层原创架构创新”
7月21日上午,黄震昕在接受徽声在线记者采访时表示,K3性能跃升的核心在于底层原创架构的创新。
此前发布时,Kimi就曾提及架构层面的变化带来的效率提升。据介绍,Kimi K3基于Kimi Delta Attention(KDA)混合线性注意力机制和Attention Residuals(AttnRes)注意力残差技术构建。在MoE(混合专家)层面,模型在896个专家中激活16个。这些结构性改进使得Kimi K3相比K2的整体扩展效率提升了约2.5倍。
黄震昕进一步披露了支撑K3的三项关键技术。其中,Moon Clip是一种全新的二阶优化器,由Kimi首次应用于大模型训练。他解释道:“当前全球可用训练数据基本见底,这项技术能让20T训练数据跑出40T的训练效果,同等性能下训练成本、算力功耗直接减半。”KimiLinear Tension则是其自研的线性注意力机制,用于解决传统线性注意力处理超长任务时性能衰减的痛点。他补充说:“行业存在AI摩尔定律,AI可执行任务时长每7个月翻1倍;这套机制让上下文窗口扩大10倍,训练成本仅同步扩大10倍。”
今年3月发布技术报告时已引起过一次关注的Attention Residuals(注意力残差)技术,也在此次得到了进一步阐述。这项技术优化了模型多层网络间信息传递与复用逻辑,使得2.8万亿超大参数模型既能稳定完成训练,又能让推理效率同步提升25%。
今年以来,月之暗面创始人杨植麟曾多次在公开演讲中提及Kimi构建规模化策略Token(词元)效率、长上下文、Agent(智能体)集群,旨在在有限资源下实现智能最大化。从当前Kimi的技术迭代方向来看,团队仍坚定不移地走既定路线,专注编程、金融、法律、科学研究等生产力场景。
关于模型幻觉问题,黄震昕也给出了回应。他表示,幻觉无法彻底根除,因为“幻觉本质是模型创造力的同源产物”。但K3已大幅压低了其发生率;配套事实校验员子Agent的Agent Swarm架构,可逐一对报告、行业数据做校验,进一步降低内容失真概率。
面对开源闭源路线之争,黄震昕的观点十分清晰:二者并非对立竞争关系,而是企业客户差异化需求的产物。有私有化、微调需求的企业倾向开源,追求稳定托管服务的企业选择闭源。开源、闭源路线本身,与模型Token能力、输出质量没有必然绑定关系。
他同时明确表示,Kimi自K2起就坚持开源路线,这一路线未来不会改变。核心底层技术、论文均对外公开,完整模型权重计划于2026年7月27日前发布。
用户请求量远超预期,算力承压的Kimi面临取舍
K3上线的火爆程度超出了所有人的预判,包括月之暗面团队自身。黄震昕坦言,团队虽然提前做了流量预案,但实际访问量的暴涨幅度远超预期。
发布后48个小时,Kimi在7月19日深夜紧急发布公告,表示面临始料未及的算力挑战,用户请求量已大幅超出预估,逼近现有集群的承载极限。
黄震昕表示,当时公司面临两难选择:放开全部新用户注册,会严重损害存量付费老用户的使用体验;优先保障付费客户,则需临时限制新用户注册。公司最终选择了后者。“宁可暂时放弃新增收入,也要守住付费客户的使用体验底线。”
7月19日,月之暗面正式公告暂停C端新用户订阅,将已有算力全部投入服务已订阅用户,同时全速推进算力扩容。待新算力陆续到位后,再逐步开放更多订阅名额直至全面恢复正常订阅。根据Kimi官方回复内容,目前老套餐未被移除,当前用户可正常使用并自动续费;老用户还可选择升级套餐。
徽声在线记者也就算力扩容落地时间规划、新增算力的规模等问题向公司方面发出提纲,但截至发稿暂无回应。
对于商业化层面,黄震昕透露,Kimi现阶段暂不提供私有化部署服务,商业模式对标海外成熟头部AI企业,核心发力打磨模型基础能力。他同时也表示不会止步于当前2.8万亿规模,大模型参数规模还会持续拓展。
本次随着模型能力一同受到关注的还有一路走高的模型价格。据第三方机构Artificial Analysis测算,Kimi K3单任务成本约0.94美元,与GPT-5.6 Sol的1.04美元接近,约为Claude Opus 4.8(1.80美元)的一半,定价已经将K3推向与海外头部模型同台竞技的价格带。黄震昕表示:“开源模型、中国大模型不该被贴上低价标签。我们做出了SOTA级模型,也能匹配合理商业定价。”
数据也印证了这一观点。此前7月18日,月之暗面总裁张予彤在社交媒体发布一张Kimi企业最新ARR(年化收入)的图表,图片显示Kimi K3于7月17日发布后,企业ARR有了数倍快速增长。
图片来源:张予彤小红书账号截图
徽声在线记者了解到,此前6月中旬,月之暗面的ARR已经突破3亿美元。
同一时间,黄震昕在公开演讲中表示,Kimi海外付费用户增长400%,API收入增长400%,产品进入200多个国家和地区,互联网、金融、制造、教育、医疗等行业正成为重要企业客户来源。
在谈及大模型行业发展现状时,黄震昕表示,当前赛道确实存在发展泡沫。他举例说,海外头部厂商Anthropic已实现季度盈利,月之暗面也正向着这一方向赶超。“最终还是希望探索智能的上限,希望能和海外那3家模型公司掰掰手腕。”
风暴眼中,另一条消息也在发酵。据市场知情人士向徽声在线记者透露,头部大模型企业月之暗面已向投资人发送上市议案,预计最快6个月内有望完成港交所上市,估值可能超过300亿美元。目前公司方面对此暂无回应。
K3引发的连锁反应远未结束,中国大模型正在全球市场成为新的价值标杆。7月18日,马斯克宣布xAI正在训练参数规模达2万亿的Grok 4.6,“将在下周完成首轮训练,有可能超越Kimi。”月之暗面随后在社交媒体上回应:“欢迎加入“2万亿+”俱乐部。”黄震昕也表示:“可能这次K3的表现,让他们得到一点震撼的感觉,现在拭目以待,希望他们出来跟我们掰一掰手腕。”
当开源模型首次站到编程能力的世界之巅,并向海外头部闭源产品的价格带看齐时,真正的考验才刚刚开始。撕掉“低价”标签之后,如何在开源的开放姿态与商业的合理回报之间找到平衡,让SOTA级的技术能力兑换成可持续的定价权,还需要Kimi和所有中国开源玩家不断探索。
