Kimi K3风暴持续:月之暗面黄震昕回应质疑,中国开源大模型定价权突围战打响
2026-07-22 18:22:40未知 作者:徽声在线
Kimi K3发布后的第四天,行业内的讨论热度依旧居高不下。
四天前,也就是7月17日凌晨,拥有2.8万亿参数的K3大模型震撼亮相,以1679分的优异成绩登顶Frontend Code Arena榜单,这是开源模型首次在该榜单上超越众多闭源模型,摘得桂冠。特斯拉CEO埃隆·马斯克在相关评测下留言称赞:“Impressive(令人印象深刻)。”这已经是马斯克今年第二次公开认可这支中国团队,早在3月,他就曾点赞Kimi的底层架构技术报告。而在马斯克预告新模型Grok 4.6时,更是将Kimi K3作为对比对象,足见其影响力。
然而,赞誉的背后也伴随着争议。K3发布仅48小时后,Kimi团队就发布声明称,用户请求量远超预期,已逼近现有集群的承载极限,因此决定暂停C端新用户订阅。这一事件被业内人士类比为“DeepSeek 2.0时刻”,引发了广泛关注。
与此同时,质疑声也不绝于耳。一方面,有外界传闻称K3是蒸馏模型;另一方面,人工智能公司OpenAI战略未来负责人迪恩·鲍尔也公开发帖抨击Kimi K3模型。他承认K3的性能无法通过蒸馏实现,但同时表示开放权重模型会削弱前沿模型的商业回报,称其为“减速主义力量”。
面对技术原创性争议、开源闭源路线之辩以及高定价策略的可持续性这三重追问,月之暗面公司企业业务负责人黄震昕直面媒体,首次系统性地回应了外界质疑。
否认蒸馏小模型猜测,强调底层原创架构创新
针对外界流传的“K3是蒸馏小模型”的猜测,7月21日上午,黄震昕在接受媒体采访时直接予以否认。他表示,K3性能跃升的核心在于底层原创架构创新,而非对现有模型的蒸馏复刻。
据介绍,K3在发布时就提到了架构层面的变化带来的效率提升。Kimi K3基于Kimi Delta Attention(KDA)混合线性注意力机制和Attention Residuals(AttnRes)注意力残差技术构建。在MoE(混合专家)层面,模型在896个专家中激活16个。这些结构性改进使得Kimi K3相比K2的整体扩展效率提升了约2.5倍。
黄震昕进一步披露了支撑K3的三项关键技术。其中,Moon Clip是一种全新二阶优化器,由Kimi首次应用于大模型训练。他解释道:“当前全球可用训练数据基本见底,这项技术能让20T训练数据跑出40T的训练效果,同等性能下训练成本、算力功耗直接减半。”Kimi Linear Tension是其自研的线性注意力机制,用于解决传统线性注意力处理超长任务时性能衰减的痛点。“行业存在AI摩尔定律,AI可执行任务时长每7个月翻1倍;这套机制让上下文窗口扩大10倍,训练成本仅同步扩大10倍。”
此外,今年3月发布技术报告时就已引起关注的Attention Residuals(注意力残差)技术,也进一步优化了模型多层网络间信息传递与复用逻辑。它让2.8万亿超大参数模型既能稳定完成训练,又能让推理效率同步提升25%。
今年以来,月之暗面创始人杨植麟曾多次在公开演讲中提及Kimi的规模化策略,包括Token(词元)效率、长上下文、Agent(智能体)集群等,旨在在有限资源下实现智能最大化。从当前Kimi的技术迭代方向来看,团队仍坚定不移地走既定路线,专注编程、金融、法律、科学研究等生产力场景。
关于模型幻觉问题,黄震昕也给出了回应。他表示,幻觉无法彻底根除,因为“幻觉本质是模型创造力的同源产物”。但K3已大幅压低了其发生率,并配套了事实校验员子Agent的Agent Swarm架构,可逐一对报告、行业数据做校验,进一步降低内容失真概率。
面对开源闭源路线之争,黄震昕的观点十分清晰:二者并非对立竞争关系,而是企业客户差异化需求的产物。有私有化、微调需求的企业倾向开源,追求稳定托管服务的企业选择闭源。开源、闭源路线本身,与模型Token能力、输出质量没有必然绑定关系。
他同时明确表示,Kimi自K2起就坚持开源路线,这一路线未来不会改变。核心底层技术、论文均对外公开,完整模型权重计划于2026年7月27日前发布。
用户请求量暴涨,算力承压的Kimi面临取舍
K3上线的火爆程度超出了所有人的预判,包括月之暗面团队自身。黄震昕坦言,团队虽然提前做了流量预案,但实际访问量的暴涨幅度远超预期。
发布后48个小时,Kimi在7月19日深夜紧急发布公告,表示面临始料未及的算力挑战,用户请求量已大幅超出预估,逼近现有集群的承载极限。
黄震昕表示,当时公司面临两难选择:放开全部新用户注册,会严重损害存量付费老用户的使用体验;优先保障付费客户,则需临时限制新用户注册。公司最终选择了后者。“宁可暂时放弃新增收入,也要守住付费客户的使用体验底线。”
7月19日,月之暗面正式公告暂停C端新用户订阅,将已有算力全部投入服务已订阅用户,同时全速推进算力扩容。待新算力陆续到位后,再逐步开放更多订阅名额直至全面恢复正常订阅。根据Kimi官方回复内容,目前老套餐没有被移除,当前用户可正常使用并自动续费;老用户也可选择升级套餐。
《每日经济新闻》记者也就算力扩容落地时间规划、新增算力的规模等问题向公司方面发出提纲,但截至发稿暂未收到回应。
对于商业化层面,黄震昕透露,Kimi现阶段暂不提供私有化部署服务,商业模式对标海外成熟头部AI企业,核心发力打磨模型基础能力。他同时也表示不会止步于当前2.8万亿规模,大模型参数规模还会持续拓展。
本次随着模型能力一同受到关注的还有一路走高的模型价格。据第三方机构Artificial Analysis测算,Kimi K3单任务成本约0.94美元,与GPT-5.6 Sol的1.04美元接近,约为Claude Opus 4.8(1.80美元)的一半,定价已经将K3推向与海外头部模型同台竞技的价格带。“开源模型、中国大模型不该被贴上低价标签。我们做出了SOTA级模型,也能匹配合理商业定价。”黄震昕说。
数据也印证了这一观点。此前7月18日,月之暗面总裁张予彤在社交媒体发布了一张Kimi企业最新ARR(年化收入)的图表,图片显示Kimi K3于7月17日发布后,企业ARR有了数倍快速增长。
图片来源:张予彤小红书账号截图
《每日经济新闻》记者了解到,此前6月中旬,月之暗面的ARR已经突破3亿美元。
同一时间,黄震昕在公开演讲中表示,Kimi海外付费用户增长400%,API收入增长400%,产品进入200多个国家和地区,互联网、金融、制造、教育、医疗等行业正成为重要企业客户来源。
在谈及大模型行业发展现状时,黄震昕表示,当前赛道确实存在发展泡沫。但他同时举例,海外头部厂商Anthropic已实现季度盈利,月之暗面也正向着这一方向赶超。“最终还是希望探索智能的上限,希望能和海外那3家模型公司掰掰手腕”。
风暴眼中,另一条消息也在发酵。据市场知情人士向《每日经济新闻》记者透露,头部大模型企业月之暗面已向投资人发送上市议案,预计最快6个月内有望完成港交所上市,估值可能超过300亿美元。目前公司方面对此暂无回应。
K3引发的连锁反应远未结束,中国大模型正在全球市场成为新的价值标杆。7月18日,马斯克宣布xAI正在训练参数规模达2万亿的Grok 4.6,“将在下周完成首轮训练,有可能超越Kimi。”月之暗面随后在社交媒体上回应:“欢迎加入“2万亿+”俱乐部。”黄震昕也表示:“可能这次K3的表现让他们得到一点震撼的感觉,现在拭目以待,希望他们出来跟我们掰一掰手腕。”
当开源模型首次站到编程能力的世界之巅,并向海外头部闭源产品的价格带看齐时,真正的考验才刚刚开始。撕掉“低价”标签之后,如何在开源的开放姿态与商业的合理回报之间找到平衡,让SOTA级的技术能力兑换成可持续的定价权,还需要Kimi和所有中国开源玩家不断探索。
