2026年7月,中国AI公司月之暗面(Moonshot AI) 投下了一枚“核弹”——Kimi K3。它不仅是全球参数规模最大的开源模型(2.8T 🚀),更凭一己之力,把硅谷关于“开源 vs 闭源”的路线之争彻底炸上了台面!
外媒称之为 “Kimi时刻”——因为这一次,开源模型第一次在参数规模、硬核性能和全球开发者声量上,同时冲进了世界第一梯队!(๑•̀ㅂ•́)و✧
📦 一、所有官方开源仓库与链接(一键直达)
| 🔗 资源类型 | 📍 链接 | 📝 说明 |
|---|---|---|
| 模型权重 | Hugging Face | 完整模型权重,总规模约1.56TB |
| 模型权重 | GitHub主仓库 | 含技术报告、部署指南、推理代码 |
| 模型权重 | ModelScope魔搭社区 | 国内镜像,加速下载 |
| 技术报告 | GitHub技术报告 | 47页PDF《Kimi K3: Open Frontier Intelligence》 |
| MoonEP | GitHub仓库 | 超大规模细粒度MoE高性能通信库 |
| FlashKDA | GitHub仓库 | KDA高性能算子库 |
| AgentEnv | GitHub仓库 | 大规模Agent训练沙箱系统 |
💡 开源协议:采用 Modified MIT 许可证,支持学术研究、本地部署与商用二次开发(商用需单独签约)。
⚙️ 二、技术深潜:2.8T庞然大物是如何“炼”成的?
📊 核心参数速览
| 📌 核心规格 | 📝 详细参数 |
|---|---|
| 总参数量 | 2.8万亿 (2.8T) 🏋️♂️(全球开源最大) |
| 激活参数 | 每次推理激活 1040亿(约占总量的3.7%) |
| 架构模式 | MoE(混合专家) —— 内部共 896个 路由专家 |
| 激活机制 | 每次推理激活 16个 专家 + 2个共享专家 |
| 网络深度 | 共计 93层(69层KDA + 24层Gated MLA) |
| 上下文窗口 | 原生支持 100万 Token 📜(1,048,576 tokens) |
| 词表大小 | 160K |
| 多模态 | 原生支持视觉理解(MoonViT-V2编码器,4.01亿参数)👁️ |
| 量化方案 | MXFP4权重 + MXFP8激活,全程量化感知训练 |
🔑 三大“黑科技”杀手锏(来自47页技术报告)
1. KDA混合线性注意力(Kimi Delta Attention)
传统Transformer的全注意力机制计算量随文本长度平方级增长。KDA采用固定大小的递归状态保存历史,将复杂度降为线性增长⚡。

-
每3层KDA搭配1层Gated MLA——KDA负责压缩,MLA负责查找
-
完全取消位置编码,依赖衰减机制隐式建模位置信息
-
KV缓存压缩75%,长文本解码速度提升6.3倍
-
在英伟达H20上,FlashKDA的prefill速度较基线方案提升 1.72至2.22倍
2. Moon Clip二阶优化器 💰
全球首次落地到大模型训练!原本需要40T的数据,现在只用20T就能达到同等效果——直接让训练成本减半!

3. 注意力残差(Attention Residuals / AttnRes)
允许各层直接检索前序所有block的输出,突破传统残差连接的信息稀释魔咒。将93层划分为9个block(7×12层+1×9层+embedding),仅在block间进行跨层检索以控制开销。
📖 技术报告原文:47页《Kimi K3: Open Frontier Intelligence》完整披露了KDA + AttnRes、Stable LatentMoE、MoonViT-V2,以及百万token上下文强化学习等技术细节。报告指出,大模型scaling存在两条轴:部署前投算力和部署后投算力,K3选择双轴并进。
📈 三、性能炸场:开源模型首次站上世界之巅!
🏆 核心评测榜单成绩
| 🧪 权威评测榜单 | 🥇 Kimi K3 成绩 | 📊 对比竞品 |
|---|---|---|
| Frontend Code Arena(前端编程) | 1679分 🥇 全球第1 | 超越Claude Fable 5(1631分)& GPT-5.6 Sol(1618分) |
| 7个前端细分领域 | 6个第一 🏆 | 品牌营销、数据分析等 |
| Artificial Analysis 智能指数 | 57分 🥉 全球第3 | 仅次于Claude Fable 5 & GPT-5.6 Sol |
| AutomationBench-AA(自动化SaaS工作流) | 53% 🥇 第1 | |
| AA-Briefcase(长程知识工作) | Elo 1547 🥈 | 仅次于Claude Fable 5(1574) |
| GPQA Diamond(研究生级科学问答) | 93.5% 🥈 | 略低于GPT-5.6 Sol(94.1%) |
| GDPval-AA v2(智能体任务) | Elo 1668 | 超越GLM-5.2(1514)、GPT-5.5(1494) |
📖 评测原文:Artificial Analysis官方评测报告:https://artificialanalysis.ai/articles/kimi-k3-achieves-3-in-the-artificial-analysis-intelligence-index
🎯 真实场景验证
-
仅凭一句话复刻完整游戏、整合二十余份研报生成图文并茂的深度分析报告
-
数字员工Devin的开发主体Cognition宣布接入Kimi K3,称其为“首款性能逼近前沿水准的开源模型”
-
可独立完成大型代码仓库迭代、GPU内核编译、CAD/芯片设计、游戏视觉开发
🌍 四、开源生态:一场全球开发者的“狂欢派对” 🥳
🎉 开源盛况
| 📦 开源事件 | 📝 具体情况 |
|---|---|
| 开源时间 | 2026年7月27日晚 |
| 社区反应 | 30分钟登顶Hugging Face趋势榜,超4000个赞 🎉 |
| Hugging Face CEO | 称这是“迄今为止最快的发布增长速度” |
| 全球Day 0适配 | 华为昇腾、摩尔线程、Nebius、Baseten、Fireworks等数十家厂商 |
| 社区移植 | Apple Silicon版(MLX port)、单机运行版(128GB内存纯Rust实现) |
🇨🇳 国产芯片0day适配
华为昇腾官方宣布:Kimi K3一经开源发布,昇腾即实现0day极速适配。
-
训练侧:基于MindSpeed MM在Atlas 800 A3、Atlas 900 A3 SuperPoD上完成适配
-
推理侧:通过vLLM Ascend与SGLang开源推理引擎实现快速部署
-
昇腾950超节点:支持FP8、MXFP8、MXFP4等全系列数值精度格式,原生支持Kimi K3的mxFP4量化权重
💡 硬件门槛提醒:虽然权重免费,但要跑起这个2.8T的巨兽,硬件投入至少200万元;做商业API服务则需1500万元起步!(╯°□°)╯
💼 五、商业与市场:重塑AI“金钱游戏”规则
💰 API定价:告别“白菜价”,价值定价时代来临
| 计费模式 | Kimi K3 价格 | 对比 |
|---|---|---|
| 缓存命中输入 | 2元 / 百万Token | |
| 未命中输入 | 20元 / 百万Token | |
| 输出(生成) | 100元 / 百万Token(约$15) | 比K2.6($4)涨了近3倍! |
横向对比:任务成本$0.94,与GPT-5.6 Sol($1.04)接近,约为Claude Opus 4.8($1.80)的一半。这标志着国产大模型首次以“价值定价”直面海外竞品!📈
🏢 微软抛来“橄榄枝” 🌊
据The Information报道,微软正在内部测试Kimi K3,评估将Copilot部分推理请求从OpenAI和Anthropic的模型迁移至K3。
-
成本节省:内部估算每年最多可减少约6亿美元(约40亿元人民币)云基础设施成本
-
单个Token推理成本:最多可下降60%
-
6亿美元相当于微软2026财年Q3智能云部门净利润的约15%
-
分析人士认为,即使最终采用,也仅限非核心、低敏感度推理负载,占比不超过20%
📖 报道原文:凤凰网科技报道:https://tech.ifeng.com/c/8uxlWUGxktU
📉 资本市场地震
-
美股AI板块三天蒸发4700亿美元
-
月之暗面完成超35亿美元F轮融资,估值升至500亿美元
-
计划在六个月内于香港上市
⚔️ 六、全球余震:撕裂硅谷的“开源之战”
🛡️ 开源vs闭源的路线之战
Kimi K3直接引爆了硅谷积压已久的矛盾:
| 阵营 | 代表巨头 | 核心行动 |
|---|---|---|
| 开源派 🆓 | 英伟达、微软、Meta、IBM、Hugging Face、Mistral、YC | 7月24日,黄仁勋发布25家公司联名公开信《开放权重与美国AI领导力》 |
| 闭源派 🔒 | OpenAI、Anthropic | 抛出“威胁论”,部分人士向白宫呼吁“封杀”中国开源模型 |
📖 公开信原文:黄仁勋在X平台发布:https://x.com/jensenhuang(公开信全文)
公开信没有直接点名Kimi K3,发布时间却恰好落在一场由K3引发的政策争论之后。近200家硅谷初创公司迅速组成「小科技联盟」,向政府发出警告:封杀廉价开源模型将直接摧毁大量资金有限的美国创业公司。
黄仁勋在接受采访时表态:美国企业 “当然应该”被允许使用中国模型,并称这些中国模型“非常优秀”。
🌐 全球AI治理
-
1134名全球AI从业者联名呼吁给AI装“刹车”
-
由中方倡导的 “世界人工智能合作组织”(29国参与)已于7月16日在上海成立
🚀 七、未来展望
😅 甜蜜的烦恼
-
算力挤爆 💥:发布48小时内,用户请求挤爆服务器,官方被迫暂停C端新用户订阅进行扩容
-
争议缠身 🤫:Anthropic指控月之暗面偷师Claude,但月之暗面用47页技术报告正面硬刚
💎 结语:意外已成趋势!
“DeepSeek时刻是一个单点突破,而Kimi K3则把意外演变成了趋势。”
Kimi K3证明了开源模型完全可以比肩顶级闭源模型,且成本更低、生态更广。未来已来,只是分布不均。Kimi K3,正在让智能重新分配! ٩(◕‿◕。)۶










暂无评论内容