Kimi负责人回应三大争议:SOTA模型应有自己的定价权
来源:21世纪经济报道作者:周慧,雷晨2026-07-22 08:22
字号
超大
标准

在北京清华东门到知春路那片咖啡飘香的地带,聚集着中国最炙手可热的AI独角兽。7月21日上午,21世纪经济报道记者来到月之暗面(Kimi)总部,该公司企业业务负责人黄震昕答复了市场关切。

这是Kimi K3自7月17日发布以来,公司面向公众的一次集中答疑。

其间,黄震昕围绕K3的技术原创性、开源闭源争议、商业化策略及落地场景等外界关注焦点,逐一给出了明确回应。

三项创新回应外界争议

7月17日,Kimi发布新一代开源模型Kimi K3,总参数达2.8万亿,原生支持视觉理解,具备100万词元(Token)上下文窗口。该模型在Frontend Code Arena榜单中以1679分超过Claude Fable 5、GPT-5.6 Sol等闭源模型位居榜首,这是开源模型首次在该榜单上超越闭源模型登顶。Code Arena由加州大学伯克利分校研究人员创建,采用匿名双盲对战机制,被视为衡量大模型编程能力的黄金参考。

埃隆·马斯克在相关评测报道评论区留言称“令人印象深刻”,并将Kimi K3列为其Grok 4.5希望追赶的目标。有媒体将此次发布引发的行业震动称为“Kimi时刻”,认为其资本市场影响可对标2025年DeepSeek取得突破时引发的震荡。

高盛研报指出,Kimi K3标志着中国模型走向定价权的全新节点;摩根士丹利评价称,Kimi K3证明中国大模型在模型规模、性能、定价层面对美国头部模型实现“全方位追赶”,并特别提到Kimi K3的API定价处于国内头部模型中较高水平。

行业争议同步发酵。OpenAI战略负责人迪恩·鲍尔(Dean W. Ball)公开评价K3性能无法依靠蒸馏实现,另有观点将开放权重模型定义为“减速主义”,认为开源会降低前沿模型商业回报、降低行业持续研发投入意愿;特朗普政府AI事务顾问戴维·萨克斯则表态“这令人担忧”。

Kimi方面未直接点名反驳,但整场交流的核心表态均与上述观点形成对照。黄震昕明确表示:“开源模型、中国大模型不该被贴上低价标签,我们做出了SOTA(最先进水平)级模型,也能匹配合理商业定价。”

针对外界流传的“K3是蒸馏小模型”的猜测,黄震昕澄清,K3性能跃升的核心来自底层原创架构创新,并非对现有模型蒸馏复刻。

现场,他重点介绍了三大底层自研技术:

1. Moon Clip:全新二阶优化器,由Kimi首次应用于大模型训练。“当前全球可用训练数据基本见底,这项技术能让20T训练数据跑出40T的训练效果,同等性能下训练成本、算力功耗直接减半。”

2. Kimi Linear Tension:自研线性注意力机制,解决传统线性注意力处理超长任务时性能衰减的痛点。“行业存在AI摩尔定律:AI可执行任务时长每7个月翻一倍;这套机制让上下文窗口扩大十倍,训练成本仅同步扩大十倍。”

3. Attention Residuals(注意力残差):马斯克曾专门发文称赞的底层技术,优化模型多层网络间信息传递、复用逻辑,让2.8万亿超大参数模型既能稳定完成训练,又能让推理效率同步提升25%。

三大底层技术分别支撑Kimi长期深耕的三大核心方向:Long Context(长上下文,由Kimi Linear Tension支撑,决定模型超长任务处理能力)、Token Efficiency(Token效率,由Moon Clip支撑,决定模型基础智能水平)、Agent Swarm(智能体集群,独立架构,决定子代理协同效率)。这三大方向也是Kimi长期不变的产品审美:公司不布局娱乐、文生图、文生视频赛道,长期聚焦编程、金融、法律、科学研究等高难度生产力场景。

坚持开源与长期主义

黄震昕在现场演示了K3落地成果:可一键生成专业咨询动态交互PPT、完整芯片行业深度研究报告(自动生成图表、周期传导逻辑图);非技术员工仅用一句话,就能生成完整GBA掌机模拟器、蜘蛛侠横版互动游戏。传统团队开发同类项目,需要建模团队以月为周期开发,借助K3可大幅压缩开发周期。

针对模型幻觉问题,黄震昕表示幻觉无法彻底根除:“幻觉本质是模型创造力的同源产物”,但K3已大幅压低幻觉发生率;配套事实校验员子Agent的Agent Swarm架构,可逐一对报告、行业数据做校验,进一步降低内容失真概率。

K3上线后用户访问量暴涨,官方一度暂停新用户注册,业内将本次算力挤兑事件类比为去年DeepSeek算力承压的“DeepSeek 2.0时刻”。黄震昕坦言,团队提前做了流量预案,但实际火爆程度远超预期。

他表示,当时公司面临两难选择:放开全部新用户注册,会严重损害存量付费老用户使用体验;优先保障付费客户,则需临时限制新用户注册。公司最终选择后者,“宁可暂时放弃新增收入,也要守住付费客户的使用体验底线”。

商业化层面,黄震昕透露,Kimi现阶段暂不提供私有化部署服务,商业模式对标海外成熟头部AI企业,核心发力打磨模型基础能力;公司收入结构中API业务占比最高,暂未对外披露私有化、行业解决方案细分营收占比。同时明确行业参数规模趋势:大模型参数规模会持续向上拓展,不会止步于当前2.8万亿规模。

针对开源、闭源路线之争,黄震昕认为二者并非对立竞争关系,企业客户存在差异化需求:有私有化、微调需求的企业倾向开源,追求稳定托管服务的企业选择闭源;开源、闭源本身和模型Token质量高低无绑定关系。

Kimi自K2起持续坚持开源路线,这一路线未来也不会改变;核心底层技术、论文均对外公开,对行业保持开放姿态。对于马斯克称Grok 4.5有望超越K3的表态,黄震昕回应:“拭目以待。”

被问及Kimi开源模式和国内其他大模型的差异时,黄震昕解释:全球开源行业拥有MIT等标准化授权协议,Kimi采用国际通用开源协议;外界误以为Kimi无法私有化部署,根源是当前K3参数量巨大、部署门槛高,和开源授权策略本身无关。

AI行业竞争白热化,Kimi主动跳出低价内卷赛道,不追逐娱乐化风口,不认同“开源=减速主义”论调;持续坚持开源并摆脱低价标签,所有技术研发、产品落地均围绕生产力场景展开。

下一步,中国大模型从单纯的“成本性价比优势”转向争夺全球市场的“价值定价权”,Kimi K3的落地或许只是行业变革的起点。

责任编辑: 胡青
声明:证券时报力求信息真实、准确,文章提及内容仅供参考,不构成实质性投资建议,据此操作风险自担
下载"证券时报"官方APP,或关注官方微信公众号,即可随时了解股市动态,洞察政策信息,把握财富机会。
为你推荐
用户评论
登录后可以发言
网友评论仅供其表达个人看法,并不表明证券时报立场
发表评论
暂无评论
时报热榜
换一换
    热点视频
    换一换