2026-07-18

又一次 DeepSeek 时刻:2.8 万亿的 Kimi K3 屠榜,中国开源模型在编程上反超了 GPT 和 Claude——还全部免费

7 月 16 号,月之暗面(Moonshot)甩出了 Kimi K3。

几个小时后,马斯克在一条测评推文底下留了俩字:「Impressive」。《财富》杂志的标题更不客气——市场的反应「像极了当年的 DeepSeek 恐慌」。CNBC 说「中国 AI 又升了一级」,Neowin 干脆下了结论:「开源模型终于追平了美国的闭源对手。」

一个中国模型,又一次把整个美国 AI 圈整不会了。

而这一次,比 DeepSeek 那次还狠。

DeepSeek 当年掀桌子,靠的是便宜——同样的活儿,我给你打到骨折价。那已经够让硅谷睡不着了。可 Kimi K3 这次亮出来的牌,不是便宜,是四个字:强,而且免费。 在最硬的战场上反超美国最强闭源,然后把这个反超了对手的模型,整个白送给全世界。

先把最硬的数字,一个个砸在这儿

嘴上谁都能吹。评判一个模型到底能不能真干活,编程和 agent 是最难注水的两个战场——代码跑不跑得通,任务做不做得成,一测便知,没法靠嘴硬。

Kimi K3 在这两块的成绩,是这样的:

这些不是月之暗面自己发布会上的 PPT 数字,是第三方测评机构 Artificial Analysis 和公开竞技场排出来的名次。

翻译成人话:在「用 AI 写代码、跑 agent 替你干活」这件今天最值钱的事上,中国的开源模型,第一次真刀真枪地站到了美国最强闭源模型的前面。不是并列,是反超。

十年了。从「中国 AI 只会抄」,到「中国 AI 只会便宜」,到今天——美国人得下载中国的模型,才能拿到最强的编程能力。 这一巴掌,分量自己掂。

2.8 万亿,全球最大,然后白送

更狠的还在后头,是它的打开方式。

Kimi K3 有 2.8 万亿参数,是目前全球最大的开源模型,差不多是第二名的两倍,也是人类历史上第一个开源的「3 万亿级」大模型。而月之暗面放话:7 月 27 号之前,把完整的模型权重全部放出来,免费。

你得对比着看,才知道这有多离谱。

GPT-5.6 Sol、Claude Fable 5,美国最强的这几个模型,你只能隔着一层 API 用——你付了钱,也只是租了个接口。模型本身长什么样、里面是什么,你摸都摸不到,更别提下载回来、私有部署、拆开改成你自己的。你就算捧着现金,也买不到 OpenAI 的权重。

而 Kimi K3 这个在编程榜上把它们反超了的模型,全世界任何一个开发者、任何一家公司、任何一个大学实验室,过几天就能整个搬回自己的服务器,随便用、随便改、一分钱不花。

一边,是锁在保险柜里、按次收费、连看一眼都不让的前沿;一边,是直接扛到你家门口、你想怎么拆就怎么拆的前沿。

美国把最强的模型锁起来收钱,中国把最强的模型敞开了送人。这个画面,十年前谁敢想。

它甚至懒得跟你拼便宜

最能看出月之暗面底气的,是价格。

按老剧本,中国 AI 的杀手锏永远该是「便宜」——DeepSeek 就是这么赢的,把价格打到地板,逼得对手集体降价。所有人都以为 Kimi 会接着这么打。

结果 Kimi K3 的定价,几乎和 Claude Sonnet 5 一模一样(每百万 token 输出 15 美元),单次任务成本 0.94 美元,只比 GPT-5.6 Sol 的 1.04 略低,压根不在「地板价」那个量级里。

这背后就一句话:我这次不屑于用便宜赢你,我要用「强」赢你。我好到可以卖得跟美国货一样贵——你爱用不用。 一个中国开源模型敢这么标价,本身就是这两年最响的一记信号。

顺便说说甩出这一切的公司

而做出 Kimi 的月之暗面,本身就是个爱看的故事。

创始人杨植麟,清华出身、90 后,创业前是发过顶级论文的 AI 研究者。公司 2023 年才成立,到今天满打满算三年多。

看它的估值曲线更过瘾:2025 年底还是约合 300 亿人民币;到 2026 年年中,新一轮融资的目标估值直接冲到 300 亿美元——一年时间,数字几乎没变,单位从人民币换成了美元,翻了七倍。美团、中国移动、中信这些巨头排着队往里塞钱。杨植麟自己说,账上躺着超过一百亿人民币,「不着急上市」。

一个三年的中国公司,一个年轻的中国团队,做出了全球最大的开源模型,在美国人最看重的编程能力上反超了 OpenAI 和 Anthropic,然后把它免费送给全世界。这故事要是拍出来,硅谷得气笑。

「柱状图我看够了」——那你去下载一个试试

当然,总有人要泼冷水,也该有人泼。

有海外开发者不服气:「柱状图我看得够多了,先拿真实的长任务连着跑几天再说。」也确实,Kimi K3 论综合智能指数排第四(57 分),还差 Claude Fable 5(60)和 GPT-5.6 Sol(59)一口气;它的幻觉率也从上一代的 39% 涨到了 51%,答得更准,但也更敢一本正经地瞎编。

这些都对。但泼这盆冷水的人,忘了最关键的一点:上面那些质疑,你没法对 GPT 和 Claude 做——因为你根本下不到它们。 而 Kimi K3,7 月 27 号之后,你可以自己下载下来,拿你手上最刁钻的真实项目往死里测。经得起测的模型不怕测,怕测的模型也送不出来。

对每天用 AI 造东西的人,这才是真正的重点

如果你也在用 AI 把一个想法直接变成能跑的真东西,比起「中美谁赢了」这种大词,Kimi K3 对你更实在的意义是这个:

那个最强的「造东西的引擎」,第一次是开源的、免费的、能整个攥在你自己手里的。

过去你想用最强的模型做原型、写前端、跑一整套 agent,只能把命脉交给几家美国公司的 API——它涨价你得认,它限流你干瞪眼,它哪天不让你用了,你辛苦搭的东西可能一夜停摆。现在你手里多了一张牌:一个能自己部署、能断网跑、还刚好在这些活儿上排全球第一的选择。

当然,榜单归榜单。K3 在测评里屠榜,不代表它在你手上那个具体的活儿上就一定最顺手。真正算数的 eval,从来是你自己的任务,不是任何一张排行榜。但这恰恰是最爽的地方:这一次,你不用求谁给你开权限,就能自己去验证它到底行不行。

7 月 27 号,权重全放。到那天,判断 Kimi K3 到底行不行的,就不再是这些榜单了,是几十万个把它搬回家、拿自己真实的活儿往死里较真的开发者。

而这几十万人里,会有越来越多,用的是中国的模型。

延伸阅读

讨论

无需登录,匿名即可发言,请友善。
加载中…