2.8万亿参数炸场!Kimi 3.0 登顶全球开源之巅
2026年7月 · 深度报道
7月16日,WAIC 开幕前夜,月之暗面扔下了一枚深水炸弹。Kimi K3,2.8万亿参数,全球参数规模最大的开源模型,在 Frontend Code Arena 前端代码竞技场上以 1679 分超越 Claude Fable 5,登顶世界第一。
这不是一次普通的产品迭代。这是中国开源大模型第一次在细分赛道上,真正站上全球之巅。今天这篇文章,我们把 Kimi K3 的全部底牌扒个干净——它强在哪、短板在哪、对普通人和开发者意味着什么。
一、Kimi K3 到底是个什么怪物?
先上硬参数:
参数规模:总参数 2.8 万亿,是目前全球最大的开源模型。相比上一代 Kimi K2 的 1 万亿,规模接近翻了两倍。
上下文窗口:最高 100 万 token,约等于一本 80 万字小说的篇幅,一次读完毫无压力。
原生多模态:原生支持视觉理解,不是后期"外挂"一个视觉模块,而是从架构层面融进去了。
架构黑科技:采用更稀疏的 MoE 架构,共设 896 个专家,每次推理仅激活其中 16 个;配合自研的 Kimi Delta Attention(KDA) 混合线性注意力机制和 Attention Residuals(AttnRes) 结构。官方称相比 K2,整体"扩展效率"提升约 2.5 倍。
发布时提供两个变体:面向对话与智能体任务的 K3 Max,以及面向大规模并行处理的 K3 Swarm Max。默认开启最高等级 Max 极致思考模式,后续将新增 Low、High 两种可选模式。
二、为什么说它"登顶"了?
在 Frontend Code Arena(前端代码竞技场)上,Kimi K3 拿下了 1679 分,力压 Claude Fable 5,登顶世界第一。在这个比拼"能不能写出能跑、好看的前端代码"的榜单上登顶,含金量不低——它意味着开源模型第一次在"生产力实战"维度正面击败了最强闭源。
消息一出,连埃隆·马斯克都在相关评测报道的评论区留下一句:"Impressive(令人印象深刻)。"
三、它真的能打闭源吗?(说句大实话)
不吹不黑。官方口径很坦诚:Kimi K3 整体表现仍落后于当前最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol。但它在整套评测中展现出前沿水平的能力,并稳定超过其他所有模型;在部分智能体榜单上,甚至超过了闭源双巨头。
翻译成人话:它不是"全面超越 GPT-5.6",而是"在开源阵营里一骑绝尘,且在特定赛道逼近甚至局部超越闭源前沿"。这个定位,反而比一味吹嘘更有说服力。
四、开源,才是真正的杀招
这是目前全球参数规模最大的开源模型。完整模型权重预计于 2026 年 7 月 27 日前全部开源——也就是说,再过不到两周,所有人都能把它下载下来,在自己的机器上跑、改、二次训练。
对开发者更友好的是:Kimi K3 兼容 OpenAI 的 SDK,迁移成本极低。定价也很克制——输入每百万 token 3 美元、输出每百万 token 15 美元,缓存输入 token 仅需 0.30 美元每百万。对比闭源前沿模型,性价比拉满。
五、最炸裂的彩蛋:AI 造 AI
如果说参数和榜单是"面子",那下面这件事才是"里子"。作为早期概念验证,Kimi K3 在连续 48 小时的自主 Agent 运行中,利用开源 EDA 工具和 Nangate 45nm 工艺库,独立完成了专用芯片的构建、优化与验证。
虽然官方也承认,当前 AI 智能水平尚不足以替代传统研发流程,但"AI 自主迭代软硬件"的趋势,已经拉开序幕。同时,月之暗面 CEO 杨植麟在 GTC 2026 上披露了 K2.5 技术路线:用 MuonClip 优化器替代 Adam、引入线性注意力、以及 Agent Swarm 多智能体协同——下一代的想象空间,比 K3 本身更大。
六、普通人现在怎么用?
网页 / App:直接打开 Kimi,体验 K3 Max 极致思考模式。
Kimi Work:桌面端,把 K3 当数字员工,跨应用执行长程任务。
Kimi Code / API:开发者可直接接入,兼容 OpenAI SDK,几行代码完成迁移。
七、写在最后:中国开源的高光时刻
新华社当天就发了通稿。2.8 万亿参数意味着什么?官方用了一个很形象的比喻:参数类似于人脑中的神经连接,规模越大,模型能在"大脑"里存储的知识和模式就越多,理解更深入、思考更周全、回答更准确。
从追赶到并跑,再到细分赛道登顶——Kimi K3 不只是一个模型,更是一个信号:开源大模型的天花板,被中国团队又顶高了一截。7 月 27 日权重开源那天,才是真正的引爆点。建议关注,别错过。
关注公众号「AI方舟人工智能」获取更多 AI 前沿深度报道

