国产模型已经崛起,亿万人必须买 Token

震撼首发
什么叫 Kimi K3 在 Arena.ai 的 Webdev 榜 上把 Claude 模型给挤下去了???
是的,你没有听错。这绝对是我今年听过最牛逼的新闻,丝毫不亚于当 DeepSeek V4 GA 正式发布时我的心情。我仿佛躺在凳子上,看着一颗原子弹爆炸。
而更炸裂的是,Kimi K3 模型将在今晚开源。这是史上第一次,一个开放权重的大语言模型站到了最顶端。Kimi K3 的 Hugging Face 页

看到这条消息,我草我感觉天都塌了。作为一个一直以来信奉国产模型不可能赢过西方模型的人,这特么简直是给我泼了一盆开水,不愧是国产 AI,真是给我特么烫开了眼,疯了吧。
Kimi K3 这是要把整个模型圈都给干翻了。
然而树大招风,消息传出来还没多久,于北京时间 7 月 22 日晚 10 点,白宫科技政策办公室主任 Michael Kratsios 便公开发帖称:
美国方面掌握信息,月之暗面在开发 Kimi K3 时蒸馏了 Anthropic 的 Claude Fable 5。
不是哥们,这谁绷得住。你的意思是月之暗面不仅研发了 Kimi K3 ,还研发出了时光机吗。
Fable 5 在 Kimi K3 发布前,仅仅只有 18 天能用。在 Kimi K3 发布前,Fable 5 对外的可用时间连三周都不到,这还能蒸馏多少 Fable 5。你 A/ 咋不早用 Mythos 5,我还想体验一下最前沿的模型。
虽然用强模型训练更小、更便宜的模型,本来就是 AI 行业的常规操作。但是这实在是令人忍俊不禁了。
毫无疑问的是,其成功的根源是技术上的创新。Kimi K3 在神经网络架构上做了意义非凡的创新。它是一个从 0 开始构建的大规模架构。通过 “线性注意力机制”,实现 1M 的超长上下文窗口。并使用新技术使得大模型训练效率能够提升 25% 。
而 Kimi K3 不是孤立事件。如果你稍微关注一下 2026 年的 AI 圈子,你会发现整个开源模型生态已经彻底变天了。
今年 4 月,DeepSeek 震撼首发。甩出了 V4 系列。V4-Flash 和 V4-Pro,全部 MIT 开源。分别是 284B 和 1.6T 参数,两个模型都是 1M 上下文窗口、使用全新的 mHC 架构。也许在那个时候确实还是什么”国产平替”,但这也为 Kimi K3 的诞生空间,打下一个基础。这样就算是突然冒出来一个中国模型能把 DeepSWE、GPQA Diamond、FrontierSWE 这些榜全部刷登顶似乎也不是很意外了。FaceDev 做的社会实验(也许吧
再往前看,阿里的 Qwen 系列早在 2025 年就已经超越了 Meta 的 Llama,成为了 Hugging Face 上下载量最大的模型系列。到 2026 年,Hugging Face 上超过 40% 的新模型衍生品都基于 Qwen 系列构建。有现成的为啥不用?有很多开发者已经把中国模型当底座来制作小模型了。
这不是一两个明星模型在为国产模型撑场面,国内模型已经正在崛起。
国产模型已经不是以性价比而言,而是开始刷榜。
至于我为什么这么说呢,看看 Kimi K3 的价格吧。

相较于 DeepSeek V4,两个模型的定价简直是天差地别。我作为一个大穷人我也是只能用的起 DeepSeek V4 了。顶多月初充个中转站狠狠蹬一把。

DeepSeek V4 的价格简直是给我吓死了。太牛逼了。
所以为什么特么 DeepSeek V4 GA 还不发啊😭😭😭😭😭😭😭我道心要破裂了。我猜是以下三个人干的😡😡😡
维亚切斯拉夫·巴兰尼科夫(Vyacheslav Barannikov)、安东·尤丁采夫(Anton Yudintsev)和尼基塔·布亚诺夫(Nikita Buyanov)

🤪🤪🤪
结语
国产模型已经崛起,亿万人必须买 Token。😡😡😡😡
2026/07/27 UTC+8 23<00>00> 记

跳票了😭😭😭特么的逗我呢
2026/07/27 UTC+8 23<18>18> 记
我去牛大了居然上了

文章分享
如果这篇文章对你有帮助,欢迎分享给更多人!
