
开源权重被免费端走,闭源城堡的门票失效了
你有没有想过,哪天你不用再给任何一家公司交"AI税"?不是偷懒不想付,是压根不用付。
我昨晚刷到一条消息,第一反应不是"牛",是后背有点凉。月之暗面把 Kimi K3 的权重开源了。2.8 万亿参数,任何人现在就能免费下载、自己部署、甚至拿去商用。
先说"权重"这词。你把它理解成模型的"大脑文件"就行——模型聪明不聪明,全在那堆数字里。过去这东西锁在公司服务器里,你每用一次都在替他们数钱。现在 K3 的权重被直接扔到网上,谁都能拖走。
我看过那阵仗。HuggingFace 上半小时点赞破 4000,登顶趋势榜,近 3700 人提前趴在页面上等下载。这不是又一家中国公司秀肌肉,是闭源巨头最怕的场景真发生了:最强模型之一的"大脑文件",免费流了出来。
有人说,开源不是慈善吗?是,但也不全是。我试过算这笔账——开源是入口战争里最狠的一招。Kimi 不跟你拼谁模型更强,而是直接把模型塞进你自己的机器,赌你下次写代码、做研究、跑工作流,第一个打开的是它。
但是!权重一旦下载到本地硬盘,谁也夺不走。闭源公司再也没法用涨价、限流、停服来拿捏你。这就有点魔幻了:封杀开源模型,本质上是在封杀数学——权重都公开了,你封谁去。

2.8 万亿参数的真身:每次只调动 1040 亿
说清楚 K3 是个什么量级。2.8 万亿参数,MoE 混合专家架构——大白话讲,就是养了 896 个"专家",每次只叫醒 16 个干活,大约 1040 亿参数在动。原生视觉理解,1M token 上下文。别人读半本《三体》都费劲,它能把三部曲加注释一口气吞下去。官方说相比上一代 K2,单位算力的智能提升约 2.5 倍。
更狠的是,Kimi 把训练它的"三件厨具"也一起开源了:高性能通信库 MoonEP、注意力算子 FlashKDA、大规模智能体训练沙箱 AgentENV。别人开源是给你菜谱,月之暗面是连锅带灶台加后厨制度全送。SGLang 和 Miles 发布当天就给了支持,单卡解码 113 token/秒,配合推测解码能到 423。顺手还扔了个 PerceptionBench,从 42 个前沿模型的失败模式里归纳出的视觉感知基准,3000 道只考单一能力的题,专治那些吹上天的模型。
为什么这么干?表面理由是降低门槛、推动创新、给用户数据控制权,Kimi 官方是这么写的。但换个角度,这是一场入口预支——当模型强到够用、又免费、还能本地跑,开发者和公司就会把工作流锚在它上面。习惯了,迁移成本就高了。

你的机器上跑着前最强模型,闭源账单在涨
对咱们这种写稿、做内容的人,这事有个绕不开的切面。过去两年我们把工作流转到 Claude、ChatGPT 上提效,但每次调用都是别人账单上的一行数。K3 开源意味着,你完全可以本地部署一个够强的模型,写稿、查资料、跑研究工作流,不再替闭源数钱。
我算过一笔真实的账。有海外团队拿同样的提示词,让 K3、Fable 5、GPT-5.6 设计同一款游戏,K3 综合 9.5 分居首,Fable 5 是 7.5。成本呢?K3 一次调用约 0.03 美元,两毛钱;Fable 5 要 0.38 美元,是 12 倍还多。一家每天调用百万次的 AI 应用,用 Fable 5 一年烧上千万,换 K3 不到一百万。省下的钱够再养一个团队。
更现实的是,今天另一头新闻是 Google 搜索结果 43% 被 AI 摘要占了,公众号流量正被截流。你手里多一个免费强模型,至少写稿和做料的本降下来,腾出精力去想分发。当然,本地跑 2.8T 不是笔记本能扛的,得有显卡或上托管平台。
最后的悬念留给 OpenAI 和 Anthropic。面对一个便宜 12 倍还开源的对手,你们选降价,还是选开源。无论选哪条,都等于承认一个事实:AI 的定价权已经不在你们手里了。而这个新东家,说中文。
所以我的建议很具体:今天就去 HuggingFace 把 K3 的权重加个关注,先不部署,先看懂它能替你干掉哪张闭源账单。等哪天你真被限流涨价惹毛了,手里已经有一个不要钱的备胎。工具买不完,但免费的那个,你至少得认识。