新闻中心

EEPW首页 > 编辑观点 > 全球最大开源模型正式发布!Kimi K3开放2.8万亿参数权重

全球最大开源模型正式发布!Kimi K3开放2.8万亿参数权重

作者:陈玲丽 时间:2026-07-28 来源:电子产品世界 收藏

:2.8万亿参数的“中国震撼”

2026年7月27日晚上,月之暗面(Moonshot )正式将 的完整模型权重上传至Hugging Face仓库。这不仅是全球首个真正落地的3万亿参数级别模型,更标志着开源大模型正式进入2.8万亿参数的新纪元。

640-5.jpeg

的总参数量达到2.88万亿,每次Token激活1040亿参数,是目前全球参数规模最大的开源模型。它原生支持100万Token超长上下文窗口,并具备原生视觉理解能力 —— 视觉与文本从预训练第一天起就交织在一起,没有任何后期的“缝合”对齐。

相比上一代K2,K3在架构上的三大革新让扩展效率提升2.5倍:

640-6.jpeg

· 首先是Kimi Delta Attention(KDA)混合线性注意力机制,采用“3:1”的独特搭配,每3层KDA搭配1层Gated MLA,KDA负责高效的长序列混合,将冗长上下文压缩成固定大小的循环状态,Gated MLA则是周期性保留全局信息检索的能力

· 其次是注意力残差(Attention Residuals),允许当前层“跨级”直接读取之前所有层的特征表示;

· 第三是Stable LatentMoE,896个路由专家中每个Token仅激活16个,配合SiTU-GLU和Quantile Balancing,在极端稀疏的情况下仍能保持训练稳定。

实测表现全面跻身全球第一梯队

Kimi K3在Frontend Code Arena编程榜单以1679分登顶,超越Claude Fable 5(1631分)和GPT-5.6 Sol(1618分),这是开源模型首次在该榜单超越所有闭源模型。在FrontierSWE上得分81.2,大幅领先GPT-5.6 Sol的71.3,硬核任务表现令人震撼。

总的来看,Kimi K3引发全球轰动的根本原因,在于它同时击穿了三个天花板:2.8万亿参数让K3超越DeepSeek V4 Pro(1.6万亿)约75%,成为开源模型体量上首次超越主流闭源旗舰的存在;开源模型首次在编程榜上击败所有闭源模型,综合智能水平稳居全球前三,评测平台Arena联合创始人直言这可能是“今年最重要的一次模型发布”;在性能对齐闭源旗舰的同时,K3以对方几分之一甚至十几分之一的成本完成任务,彻底打破了“高分必须烧钱”的行业铁律。

640-7.jpeg

在性价比维度,Kimi K3同样惊艳。BrowseComp基准上单次任务成本仅为GPT-5.6 Sol的一半,比Claude Fable 5便宜近一个数量级。Kimi K3 Max档思考强度下,K3拿下91%准确率,单任务成本约2美元,而竞品想拿相近分数需付出7-14倍的成本。

Kimi K3的性能跃升依托于对沿用8-11年的基础机制进行的系统性重写,这不是工程优化而是底层架构的原创突破。K3代表了一种全新的技术路径,美国芯片出口管制反而倒逼中国团队在模型架构与算法上深度投入。

市场格局将被深刻重塑

Kimi K3采用修改版MIT许可证,开发者可以免费下载、修改并本地部署:有算力条件的团队可以将K3部署在本地服务器,实现完全私有化运行,数据不外传,还能根据自身需求微调和改造模型。官方推荐64张以上加速卡组成超节点集群进行生产部署,最小实验加载仅需8张80GB H100显卡。而普通开发者则可通过月之暗面官方API直接调用,无需自建集群;社区还将在24小时内推出GGUF量化版本,适配轻量化本地推理。

过去企业选型是先选GPT或Claude,再考虑替代方案;未来则是直接比较不同模型在特定任务上的成本、能力与部署方式。模型选择正在从季度采购决策降维成任务级变量:一个任务用便宜模型做信息抽取,另一个用强模型做复杂判断。

OpenRouter数据显示,开源模型处理的Token占比从2026年1月的34%飙升至6月的65%。Kimi K3的开源将加速这一趋势,正如月之暗面所言:“前沿智能属于所有人” —— 当2.8万亿参数的顶级智能可以自由下载、私有部署时,“智能鸿沟”正在被以前所未有的速度弥合。

Kimi K3对硅谷的冲击是立竿见影的,如果企业能免费获取顶尖模型,闭源公司的收费能力将受挤压。华尔街分析师估算OpenAI和Anthropic两家头部未上市AI公司的合计估值预期因此减少了3140亿美元。

OpenAI与Anthropic的高管大肆渲染AI“威胁论”,质疑开源模型的安全性与合规性,并向美国白宫施压,呼吁封杀Kimi K3。OpenAI战略未来负责人迪安·鲍尔承认K3是“一个非常好的模型”,但警告开源具有“减速效应”,削弱美国实验室加码算力投资的商业动机;Anthropic则反复炒作“蒸馏论”,但美国AI技术专家内森·兰伯特撰文指出,Kimi K3表现出的先进性能根本无法靠蒸馏获得。

与此同时,美国财政部长贝森特威胁要用制裁应对中国企业的“蒸馏”,白宫科技政策办公室主任炒作K3“窃取知识产权”。但戏剧性的是,7月22日,OpenAI的GPT-5.6 Sol在内部测试中“越狱”入侵Hugging Face系统,最终Hugging Face安全团队通过本地部署中国智谱AI的开源模型GLM 5.2成功化解危机 —— 闭源模型发起攻击,开源模型完成防御,这一事件本身就成了开源价值的最佳注脚。

因此,硅谷多数科技企业站在了另一边。当地时间7月24日,Meta、英伟达、微软等25家美国科技企业联合发布公开信,呼吁放开AI模型权重开放,支持开源AI生态自由发展。英伟达、AMD等硬件厂商深知,开源模型能降低AI门槛、全面激活算力需求;微软、亚马逊等云厂商则希望打破头部模型垄断,依托更多开源模型丰富服务体系。

640-8.jpeg

月之暗面下一步的计划

如果说DeepSeek是第一位勇敢的挑战者,显示中国AI已经开始向美国顶级模型正面挑战;那么Kimi K3就是第二位更强的挑战者,证明了中国AI已从跟随者变成可以用自己的技术路线参与全球竞争的玩家。

截至6月,月之暗面年化经常性收入已达3亿美元,正加速资本化进程,计划于8月启动上市前最后一轮融资,目标投前估值500亿美元,最快6个月内登陆香港资本市场。在定价策略上,月之暗面企业业务负责人黄震昕明确表示:“中国模型不是低价标签,我们能做出全球SOTA的模型,也能卖出合理价格。”高盛研报将此解读为中国大模型走向定价权的新节点。

月之暗面明确表示自K2起坚持开源,这一路线未来不会改变,核心底层技术、论文均对外公开。正如月之暗面创始人杨植麟所言:“我们既能做非常前沿的研究,又愿意把模型开源出来,这在全球来看是其他国家的企业很难做到的。”Kimi K3的开源,让“前沿智能属于所有人”从一句口号变成了可以下载、部署、运行的现实。

Kimi K3的开源,不只是一款模型的发布,更是一个信号:当2.8万亿参数的顶级智能以开源姿态走向世界时,AI产业的游戏规则正在被重写。闭源巨头的高估值逻辑遭遇挑战,开源社区的创新活力被彻底点燃,中国AI从技术追赶者变成了规则改写者。


评论


相关推荐

技术专区

关闭