马斯克点赞的开源模型刷屏,Kimi K3到底有什么不一样?
2.8万亿参数、全球最大开源模型、前端编程全球第一。7月17日凌晨,月之暗面发布Kimi K3,消息一出,迅速刷屏。连马斯克都在评论区留言“Impressive”(令人印象深刻)。
图源:月之暗面
那么,Kimi K3到底有什么不一样?能干什么?
首先是参数大。2.8万亿参数,超过Deep Seek V4的1.6万亿和文心大模型5.0的2.4万亿。
但对大模型而言,光堆参数不是本事,关键在于——这2.8万亿参数,能干嘛?
月之暗面展示了几个案例:
AI自己设计AI芯片。 K3连续运行48小时,利用开源EDA工具和45nm工艺库,独立完成了一款专用芯片的构建、优化与验证。芯片面积4mm²,集成146万个标准单元。虽然不是量产级芯片,但“AI自己设计AI芯片”这个闭环,确实少见。
2小时完成两周的研究工作。在复现天体物理I-Love-Q关系时,K3阅读并交叉验证了20多篇论文,评估了300多种状态方程,生成了3000多行Python代码。
用56段素材剪出品牌视频。完成选片、动作匹配、逐帧卡点、音频处理和多轮修改——这类工作通常需要专业剪辑师1到2个工作日。
大模型的参数越大越好吗?
这是很多人看到“2.8万亿”时的第一反应。
北京邮电大学人工智能学院教授王小捷说,大模型的参数近3万亿,意味着模型懂得更多、想得更深,能干的事情也越多,和能力上限相关。但当参数超过某个临界值(约650亿)时,模型会具备数学推理、代码生成等小模型不具备的能力——这叫“智能涌现”。
国外闭源模型目前参数能达到十万亿级别。
当然,官方也承认:Kimi K3综合能力仍落后于Claude Fable 5和GPT-5.6 Sol。但能在部分领域实现反超,已经是一个重要信号。
一个值得注意的细节:使用价格不便宜了。
Kimi K3的API定价是:输入每百万Token 2元(缓存命中)和20元(缓存未命中),输出100元。按美元计,输出价格为每百万Token 15美元——和Claude一个价。
这是中国大模型第一次照着美国顶级模型的价目表收费。
过去国产模型打的是“性价比”牌,现在K3选择了另一条路:性能对标,价格也对标。
王小捷告诉记者,大模型的参数可以堆,但能不能在真实世界里持续稳定地干活——那才是真本事。如今,国产大模型迈出了大参数一步,在实用方面也在进步,但后面追赶世界最先进大模型的路,也还有一段距离。
“目前行业内对AI大模型的关注更多的是推理能力和自我探索能力。在这方面,国内大模型还需更多努力。”王小捷说。
原标题:《马斯克点赞的开源模型刷屏,Kimi K3到底有什么不一样?》

