月之暗面Kimi K3解析:2.8万亿参数的开源巨兽震动全球AI格局

月之暗面Kimi K3解析:2.8万亿参数的开源巨兽震动全球AI格局

图片[1]-月之暗面Kimi K3解析:2.8万亿参数的开源巨兽震动全球AI格局 - 咸鱼科技躺盐社区-咸鱼科技躺盐社区
生成摘要
AI 生成,仅供参考

2026年7月,中国AI公司月之暗面(Moonshot AI) 投下了一枚“核弹”——Kimi K3。它不仅是全球参数规模最大的开源模型(2.8T 🚀),更凭一己之力,把硅谷关于“开源 vs 闭源”的路线之争彻底炸上了台面!

外媒称之为 “Kimi时刻”——因为这一次,开源模型第一次在参数规模、硬核性能和全球开发者声量上,同时冲进了世界第一梯队!(๑•̀ㅂ•́)و✧


📦 一、所有官方开源仓库与链接(一键直达)

 
 
🔗 资源类型 📍 链接 📝 说明
模型权重 Hugging Face 完整模型权重,总规模约1.56TB
模型权重 GitHub主仓库 含技术报告、部署指南、推理代码
模型权重 ModelScope魔搭社区 国内镜像,加速下载
技术报告 GitHub技术报告 47页PDF《Kimi K3: Open Frontier Intelligence》
MoonEP GitHub仓库 超大规模细粒度MoE高性能通信库
FlashKDA GitHub仓库 KDA高性能算子库
AgentEnv GitHub仓库 大规模Agent训练沙箱系统

💡 开源协议:采用 Modified MIT 许可证,支持学术研究、本地部署与商用二次开发(商用需单独签约)


⚙️ 二、技术深潜:2.8T庞然大物是如何“炼”成的?

📊 核心参数速览

 
 
📌 核心规格 📝 详细参数
总参数量 2.8万亿 (2.8T) 🏋️‍♂️(全球开源最大)
激活参数 每次推理激活 1040亿(约占总量的3.7%)
架构模式 MoE(混合专家) —— 内部共 896个 路由专家
激活机制 每次推理激活 16个 专家 + 2个共享专家
网络深度 共计 93层(69层KDA + 24层Gated MLA)
上下文窗口 原生支持 100万 Token 📜(1,048,576 tokens)
词表大小 160K
多模态 原生支持视觉理解(MoonViT-V2编码器,4.01亿参数)👁️
量化方案 MXFP4权重 + MXFP8激活,全程量化感知训练

🔑 三大“黑科技”杀手锏(来自47页技术报告)

1. KDA混合线性注意力(Kimi Delta Attention) 

传统Transformer的全注意力机制计算量随文本长度平方级增长。KDA采用固定大小的递归状态保存历史,将复杂度降为线性增长

d064b22b0e2504dec968a645071af5e0_k3-opensource-progress_fit=max&auto=format&n=no4X7IUdjGtP_MH_&q=85&s=bc2cc9afeaec649be37c812f0b8c5325

  • 每3层KDA搭配1层Gated MLA——KDA负责压缩,MLA负责查找

  • 完全取消位置编码,依赖衰减机制隐式建模位置信息

  • KV缓存压缩75%,长文本解码速度提升6.3倍

  • 在英伟达H20上,FlashKDA的prefill速度较基线方案提升 1.72至2.22倍

2. Moon Clip二阶优化器 💰

全球首次落地到大模型训练!原本需要40T的数据,现在只用20T就能达到同等效果——直接让训练成本减半

e5ebb2bf8118b7461f4a463933e401dc_k3-arch_fit=max&auto=format&n=no4X7IUdjGtP_MH_&q=85&s=b83048095b73528f2a601698f5b51ddd

3. 注意力残差(Attention Residuals / AttnRes) 

允许各层直接检索前序所有block的输出,突破传统残差连接的信息稀释魔咒。将93层划分为9个block(7×12层+1×9层+embedding),仅在block间进行跨层检索以控制开销

📖 技术报告原文:47页《Kimi K3: Open Frontier Intelligence》完整披露了KDA + AttnRes、Stable LatentMoE、MoonViT-V2,以及百万token上下文强化学习等技术细节。报告指出,大模型scaling存在两条轴:部署前投算力和部署后投算力,K3选择双轴并进


📈 三、性能炸场:开源模型首次站上世界之巅!

🏆 核心评测榜单成绩

 
 
🧪 权威评测榜单 🥇 Kimi K3 成绩 📊 对比竞品
Frontend Code Arena(前端编程) 1679分 🥇 全球第1 超越Claude Fable 5(1631分)& GPT-5.6 Sol(1618分)
7个前端细分领域 6个第一 🏆 品牌营销、数据分析等
Artificial Analysis 智能指数 57分 🥉 全球第3 仅次于Claude Fable 5 & GPT-5.6 Sol
AutomationBench-AA(自动化SaaS工作流) 53% 🥇 第1  
AA-Briefcase(长程知识工作) Elo 1547 🥈 仅次于Claude Fable 5(1574)
GPQA Diamond(研究生级科学问答) 93.5% 🥈 略低于GPT-5.6 Sol(94.1%)
GDPval-AA v2(智能体任务) Elo 1668 超越GLM-5.2(1514)、GPT-5.5(1494)

📖 评测原文:Artificial Analysis官方评测报告:https://artificialanalysis.ai/articles/kimi-k3-achieves-3-in-the-artificial-analysis-intelligence-index

🎯 真实场景验证

  • 仅凭一句话复刻完整游戏、整合二十余份研报生成图文并茂的深度分析报告

  • 数字员工Devin的开发主体Cognition宣布接入Kimi K3,称其为“首款性能逼近前沿水准的开源模型”

  • 可独立完成大型代码仓库迭代、GPU内核编译、CAD/芯片设计、游戏视觉开发


🌍 四、开源生态:一场全球开发者的“狂欢派对” 🥳

🎉 开源盛况

 
 
📦 开源事件 📝 具体情况
开源时间 2026年7月27日晚
社区反应 30分钟登顶Hugging Face趋势榜,超4000个赞 🎉
Hugging Face CEO 称这是“迄今为止最快的发布增长速度”
全球Day 0适配 华为昇腾、摩尔线程、Nebius、Baseten、Fireworks等数十家厂商
社区移植 Apple Silicon版(MLX port)、单机运行版(128GB内存纯Rust实现)

🇨🇳 国产芯片0day适配

华为昇腾官方宣布:Kimi K3一经开源发布,昇腾即实现0day极速适配

  • 训练侧:基于MindSpeed MM在Atlas 800 A3、Atlas 900 A3 SuperPoD上完成适配

  • 推理侧:通过vLLM Ascend与SGLang开源推理引擎实现快速部署

  • 昇腾950超节点:支持FP8、MXFP8、MXFP4等全系列数值精度格式,原生支持Kimi K3的mxFP4量化权重

💡 硬件门槛提醒:虽然权重免费,但要跑起这个2.8T的巨兽,硬件投入至少200万元;做商业API服务则需1500万元起步!(╯°□°)╯


💼 五、商业与市场:重塑AI“金钱游戏”规则

💰 API定价:告别“白菜价”,价值定价时代来临

 
 
计费模式 Kimi K3 价格 对比
缓存命中输入 2元 / 百万Token  
未命中输入 20元 / 百万Token  
输出(生成) 100元 / 百万Token(约$15) 比K2.6($4)涨了近3倍!

横向对比:任务成本$0.94,与GPT-5.6 Sol($1.04)接近,约为Claude Opus 4.8($1.80)的一半。这标志着国产大模型首次以“价值定价”直面海外竞品!📈

🏢 微软抛来“橄榄枝” 🌊

The Information报道,微软正在内部测试Kimi K3,评估将Copilot部分推理请求从OpenAI和Anthropic的模型迁移至K3

  • 成本节省:内部估算每年最多可减少约6亿美元(约40亿元人民币)云基础设施成本

  • 单个Token推理成本:最多可下降60%

  • 6亿美元相当于微软2026财年Q3智能云部门净利润的约15%

  • 分析人士认为,即使最终采用,也仅限非核心、低敏感度推理负载,占比不超过20%

📖 报道原文:凤凰网科技报道:https://tech.ifeng.com/c/8uxlWUGxktU

📉 资本市场地震

  • 美股AI板块三天蒸发4700亿美元

  • 月之暗面完成超35亿美元F轮融资,估值升至500亿美元

  • 计划在六个月内于香港上市


⚔️ 六、全球余震:撕裂硅谷的“开源之战”

🛡️ 开源vs闭源的路线之战

Kimi K3直接引爆了硅谷积压已久的矛盾:

 
 
阵营 代表巨头 核心行动
开源派 🆓 英伟达、微软、Meta、IBM、Hugging Face、Mistral、YC 7月24日,黄仁勋发布25家公司联名公开信《开放权重与美国AI领导力》
闭源派 🔒 OpenAI、Anthropic 抛出“威胁论”,部分人士向白宫呼吁“封杀”中国开源模型

📖 公开信原文:黄仁勋在X平台发布:https://x.com/jensenhuang(公开信全文)

公开信没有直接点名Kimi K3,发布时间却恰好落在一场由K3引发的政策争论之后近200家硅谷初创公司迅速组成「小科技联盟」,向政府发出警告:封杀廉价开源模型将直接摧毁大量资金有限的美国创业公司

黄仁勋在接受采访时表态:美国企业 “当然应该”被允许使用中国模型,并称这些中国模型“非常优秀”

🌐 全球AI治理

  • 1134名全球AI从业者联名呼吁给AI装“刹车”

  • 由中方倡导的 “世界人工智能合作组织”(29国参与)已于7月16日在上海成立


🚀 七、未来展望

😅 甜蜜的烦恼

  • 算力挤爆 💥:发布48小时内,用户请求挤爆服务器,官方被迫暂停C端新用户订阅进行扩容

  • 争议缠身 🤫:Anthropic指控月之暗面偷师Claude,但月之暗面用47页技术报告正面硬刚

💎 结语:意外已成趋势!

“DeepSeek时刻是一个单点突破,而Kimi K3则把意外演变成了趋势。”

Kimi K3证明了开源模型完全可以比肩顶级闭源模型,且成本更低、生态更广。未来已来,只是分布不均。Kimi K3,正在让智能重新分配! ٩(◕‿◕。)۶

 
© 版权声明
THE END
喜欢就支持一下吧
点赞7赞赏一下 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容