今天,月之暗面的 Kimi K3 把完整权重甩到了 HuggingFace 上。2.8 万亿参数,Modified MIT 许可,任何人能下载、改、自己部署。
这是目前人类放出过的最大开源模型,没有之一。但有个数字你得先记住:在独立幻觉测试里,它一半以上的时候在编。
下半夜能下,但你的硬盘扛不住
权重文件大约 594 GB。什么概念?一部 4K 电影也就几 GB,这等于你下了一百多部电影。下载完只是第一步——要把它真正跑起来做推理,你手头得有大约 1.4 TB 的显卡显存,月之暗面建议把 64 张加速卡绑成一台机器一起使。
换个说法:这不是你工作室能自己扛的事。64 张顶配卡,小团队根本没这基础设施。能立刻自己部署的,只有云厂商、推理服务商和极少数巨头。
2.8 万亿听着吓人,其实每次只叫醒 500 亿
K3 是 MoE 架构。2.8 万亿是总参数,但每处理一个 token,它只激活其中约 500 亿——896 个专家层里挑 16 个上班。这正是它敢说“服务成本能和体积小很多的模型打”的底气。
技巧归技巧,规模归规模。K3 在编程上确实强:前端代码 Arena 以 1679 分登顶,48 小时自主跑完一颗芯片设计。但写代码和“说真话”是两件事。
真正的新料:它比上一代更会编了
独立评测方用 AA-Omniscience 幻觉基准测了 K3,结果它在 约 51% 的用例里产生了幻觉。它的上一代 K2.6 是 39%。
注意方向:这不是进步,是退步,而且退在“生产环境最要命的地方”。你拿它写代码、做推理链没问题;但你拿它当知识库、做客服问答、生成要对外发的报告,它就可能在你不知道的时候编一段看起来特别真的瞎话。
这不是我吓你。月之暗面自己的负责人也说过,K3 综合能力“逼近”Fable 5 和 GPT-5.6,但“仍有差距”。差距恰恰在事实可靠性上。
数据主权:今天起你能躲开“中国 API”了
K3 发布时,用它的唯一方式是走月之暗面的 API——服务器在中国。这对企业意味着两件事:数据出境,以及中国法律下的数据义务。
今天权重开放后,有基础设施的团队可以自己托管,数据不出自己机房,大部分 API 风险直接消失。代价是那 64 张卡。
还有一笔旧账得提一句:2026 年 4 月,月之暗面基础设施出过一次跨用户数据泄露,公司从没公开回应过。你要不要把它算进供应商风险评估,是你自己的判断。
跟你有啥关系
先说结论:你大概率自己跑不了 K3。但你作为甲方,议价权变了。
- 小团队、工作室:别想着本地部署,走推理服务商(他们帮你跑权重),价格大概率比月之暗面官方 API 便宜。
- 做开发的:立刻让团队用 K3 跑代码生成和 Review,这块基准是真的强,而且开源模型进场会压低所有人的 API 报价——你拿这个去和 Anthropic、OpenAI 谈价,腰杆更硬。
- 做知识类产品的:K3 先别直接上对外问答,一定加一层验证。51% 的幻觉率不是不能用,是不能裸用。
一句话:今天开源史上最大的一块砖下来了。砖是好砖,但别拿它当承重墙——尤其别拿它扛“说什么都得是真的”那面墙。
