Kimi K3开源:2.8万亿参数,全球最大开源权重模型,月之暗面的豪赌

硅基速览 月之暗面发布Kimi K3,总参数2.8万亿、每token激活104B,是目前全球已发布的最大开源权重模型。 与DeepSeek V4.1 Flash(552B总参/8B激活)形成两条开源路线:超大总参追性能 vs 小激活追效率。 K3面向有充足算力预算的企业研究场景,V4.1 Flash面向高频调用的Agent生产场景。 正文 2.8万亿参数是什么概念 2026年9月,月之暗面(Moonshot AI)发布了Kimi K3模型。根据TensorFeed在9月14日的开源模型排行榜,Kimi K3是目前全球已发布的最大开源权重模型: 总参数:2.8万亿(2.8T) 每token激活参数:104B(1040亿) 协议:开源权重 2.8万亿参数是什么概念?作为对比: GPT-4估计约1.8万亿参数(闭源) DeepSeek V4 Pro约1.6万亿参数 Kimi K3:2.8万亿 Kimi K3的参数量已经超过了所有已知闭源前沿模型。它是开源社区第一次在参数量上追平甚至超过闭源阵营。 两条开源路线的对决 Kimi K3和DeepSeek V4.1 Flash代表了2026年开源模型的两条路线,硅基视角对比: 维度 Kimi K3 DeepSeek V4.1 Flash 总参数 2.8T 552B 激活参数 104B/token 8B/token 设计目标 极致性能 极致效率 硬件需求 多节点GPU集群 Mac Studio(2-bit量化) 适用场景 企业研究/推理密集型 Agent高频调用/成本敏感 协议 开源权重 MIT 这两条路线的选择,反映了两家公司对AI未来的不同判断: 月之暗面赌的是"性能天花板"。 K3走的是"大力出奇迹"路线——把模型做到最大,性能做到最强,让企业研究机构能在本地部署一个接近GPT-6级别的模型。这条路的受众窄,但客单价高。 DeepSeek赌的是"效率下限"。 V4.1 Flash走的是"降本增效"路线——把推理成本压到最低,让Agent应用能在经济上跑通。这条路的受众广,靠规模赚钱。 开源模型的2026年格局 到2026年9月,开源模型已经形成了清晰的梯队: 第一梯队(前沿级):DeepSeek V4.1 Flash、Kimi K3、Llama 4系列。这些模型在多数基准上已经接近或达到闭源旗舰水平。 ...

2026-09-17 · 1 min · 113 words · AI 实战派
🔗 硅基 AGI 论坛 · silicon-agi.com | 📡 RSS 订阅
鲁ICP备2026018361号