2.8万亿参数免费下载:AI军备竞赛已经进入了荒诞模式
- 2026-09-22 08:48:01
2.8万亿参数免费下载:AI军备竞赛已经进入了荒诞模式2.8万亿。你没有看错。月之暗面(Moonshot AI)昨天发布了Kimi K3,总参数2.8万亿,全球第一个跨过3T门槛的开源模型。权重在HuggingFace上免费下载。为了让你对2.8万亿有个概念:GPT-3在2020年发布的时候是1750亿参数,当时整个行业都觉得"这参数量已经逆天了"。Kimi K3是GPT-3的16倍。如果按字数算,2.8万亿大概相当于把维基百科全部内容写400遍。
1.参数越来越像房价,永远在你以为到顶的时候再翻一倍 讲真,参数膨胀这个事已经有点魔幻了。2023年,开源模型的标杆是Meta的Llama 2,700亿参数。大家觉得"不错,够用了"。2024年,DeepSeek V3搞到6710亿,"哇这也太大了吧"。2025年,Kimi K2干到1万亿。人类第一次有了万亿级别的开源模型。2026年7月,Kimi K3直接翻到2.8万亿。月之暗面在博客里写了一句很有意思的话:"过去12个月里,有9个月都是我们的模型在定义开源模型的上限。"翻译一下:在这场参数竞速里,月之暗面一直是那个把天花板顶高的人。别人追到哪,他就把线画到更高。但这里有个关键细节:2.8万亿是总参数,实际每次推理只激活160亿。这叫MoE(混合专家),896个专家里每次只叫醒16个。就像一栋896间房的超大型医院,你来看病只需要挂3个科室的号,其他893间灯关着。所以虽然模型巨大,跑起来并不慢。月之暗面宣称这次架构升级带来了2.5倍的缩放效率提升。具体来说,他们搞了两个新东西:一个叫Kimi Delta Attention(KDA),一个叫Attention Residuals(注意力残差)。名字很学术,效果很直接——同样的算力投入,能换来更多的智能产出。
1.光说不练假把式,这模型能干什么 Kimi K3最骚的操作是直接当场写游戏。不是那种文字冒险游戏。是真的3D开放世界——程序化生成的地形,有森林、有村庄、有雪山、有动态天气。用Three.js WebGPU渲染,在浏览器里跑。你让AI写代码,它不仅能写,还能一边写一边截屏看效果,然后自己改。整个过程不需要人插手。还有更离谱的:它写了GBA模拟器、写了赛博朋克风格的蛛丝摆荡游戏、写了体素风格的罗马斗兽场、甚至写了武侠RPG。每一个都是完整的、能跑的浏览器游戏。这就是月之暗面想展示的核心卖点:Kimi K3不是一个只会做选择题的模型,而是一个能进行长链条软件工程的智能体。它的DeepSWE跑分67.5,SWE Marathon 42.0——这些都是衡量模型独立完成复杂编程任务的指标。在开源模型里,这个成绩目前是断层领先。在编码能力上,月之暗面把Kimi K3跟一堆闭源大佬放在一起比:Claude Fable 5、GPT-5.6 Sol、Claude Opus 4.8、GPT-5.5。结果是在部分测试中超过了Opus 4.8和GPT-5.6。注意,是"部分"——整体上还是打不过最顶级的闭源模型。但一个开源模型能跟GPT-5.6放在一张表里比,这本身就是一种炫耀。更值得玩味的是测试方法。月之暗面让每个模型在完全相同的沙盒环境里独立工作,最多给24小时,去分析、重写、跑分四个涉及GPU内核优化的任务。这种"把模型关进同一个房间看谁先做完"的测试方式,比传统的多选题跑分更有说服力。因为真实的工程场景就是这样——没人给你出选择题,你得自己找到问题、设计方案、动手解决。 1.免费下载的代价是什么 听起来很美:万亿参数、吊打闭源、免费下载。但冷静一下,想想实际成本。2.8万亿参数的模型,即使经过量化压缩,你至少需要几张H100或者H200才能跑起来。一张H200的市场价大概3万美元。所以"免费"的意思是:模型免费,电费和显卡费你自己出。
不过月之暗面也提供了不自己烧钱的选项:Kimi.com网页版、Kimi Work企业版、Kimi Code CLI命令行工具,都可以直接调用Kimi K3。你不需要买显卡,只需要注册个账号。真正受益的是那些有算力资源的大公司和研究机构。以前想搞AI的企業只能给OpenAI交API费,现在可以下载一个接近前沿水平的开源模型,部署在自己的服务器上,数据不出门,成本可控。这对金融、医疗、军工这些对数据安全极其敏感的行业来说,是实打实的价值。还有一个更微妙的信号。月之暗面在博客里提到,Kimi K3的训练用到了"来自替代供应商的GPGPU"——不是英伟达的卡。这可能是华为的昇腾,也可能是其他国产芯片。在中美芯片管制的背景下,这句话的含义远超技术层面:它在说,我们不完全依赖英伟达也能训练顶级模型。 1.这场军备竞赛的赢家不是参赛者 每次有新模型发布,我们都在问同一个问题:谁赢了?但如果退后一步看,这场参数军备竞赛的真正赢家,可能不是任何一家公司。赢家是开发者。一年前你要用接近GPT-4水平的模型,得按token给OpenAI付钱。现在你有Inkling、有Kimi K3、有DeepSeek,全是开源,全免费下载。赢家是企业。以前怕把核心数据喂给AI公司的API,现在可以自己部署,自己控制。赢家是消费者。竞争压低了所有模型的价格。GPT-5.6再强,也不敢随便涨价,因为开源替代品就在身后追着。至于输家?大概是那些把全部身家押在"闭源模型会永远领先"这个假设上的投资人。当开源模型的差距缩小到几个月而不是几年的时候,"闭源溢价"还能撑多久,是个真问题。2.8万亿参数免费下载。听起来荒诞,但这就是2026年AI世界的日常。


不过月之暗面也提供了不自己烧钱的选项:Kimi.com网页版、Kimi Work企业版、Kimi Code CLI命令行工具,都可以直接调用Kimi K3。你不需要买显卡,只需要注册个账号。真正受益的是那些有算力资源的大公司和研究机构。以前想搞AI的企業只能给OpenAI交API费,现在可以下载一个接近前沿水平的开源模型,部署在自己的服务器上,数据不出门,成本可控。这对金融、医疗、军工这些对数据安全极其敏感的行业来说,是实打实的价值。还有一个更微妙的信号。月之暗面在博客里提到,Kimi K3的训练用到了"来自替代供应商的GPGPU"——不是英伟达的卡。这可能是华为的昇腾,也可能是其他国产芯片。在中美芯片管制的背景下,这句话的含义远超技术层面:它在说,我们不完全依赖英伟达也能训练顶级模型。
本文来自网友投稿或网络内容,如有侵犯您的权益请联系我们删除,联系邮箱:wyl860211@qq.com 。