Kimi K3 重磅发布:全球最大开源模型

Kimi K3 重磅发布:全球最大开源模型

2026 年 7 月 16 日,月之暗面(Moonshot AI)在 2026 世界人工智能大会前夕正式发布了新一代基座大模型 Kimi K3。参数规模达到 2.8 万亿,这是目前全球参数最大的开源模型,标志着开源大模型正式迈入"3T 级"时代。

一、Kimi K3 是什么?

Kimi K3 是月之暗面迄今能力最强的旗舰模型,基于自主研发的底层模型架构构建,原生支持视觉理解,拥有 100 万 token 上下文窗口。它面向软件工程、知识工作、深度研究、多模态理解等复杂任务场景进行了全面的优化。关键参数参见如下:

参数

数值

总参数量

2.8 万亿

激活专家数

16/896(MoE 架构)

上下文窗口

100 万 token

视觉能力

原生支持

开源计划

2026 年 7 月 27 日开放完整权重

API 定价(输出)

$15.00/MTok

二、核心技术突破

Kimi K3 并不是简单地堆参数——它在底层架构上做了大量原创创新。

1. Kimi Delta Attention(KDA)混合线性注意力机制

KDA 是 K3 的核心架构创新之一。它为扩展注意力机制提供了高效的基础,让信息在更长序列中流动得更顺畅。这种机制结合了传统注意力和线性注意力的优势,有效解决了超长上下文场景下的性能瓶颈。

2. Attention Residuals(注意力残差)

这项技术优化了模型多层网络之间的信息传递与复用逻辑。它不仅让 2.8 万亿超大参数模型能够稳定完成训练,还让推理效率同步提升了 25%。特斯拉 CEO 马斯克曾专门发文称赞这项技术。

3. Moon Clip 二阶优化器

一个全新设计的优化器,由 Kimi 首次应用于大模型训练。在当前全球训练数据基本见底的情况下,Moon Clip 能实现 20T 训练数据跑出 40T 的训练效果,同等性能下训练成本和算力功耗直接减半。

4. Stable LatentMoE 框架

K3 采用混合专家(MoE)架构,在总共 896 个专家中每次仅激活 16 个。Stable LatentMoE 框架确保了在极高稀疏度下路由和优化的稳定性。相比 Kimi K2,整体扩展效率提升了约 2.5 倍

三、性能表现有多强?

1. 编程能力

K3 在编程领域表现尤为亮眼。它以 1679 分登顶 Frontend Code Arena 前端编程榜单,首次让开源模型在该榜单上超越一众闭源模型,包括 GPT、Claude 等顶级模型。

在 SWE Marathon 长程编程任务中,K3 得分 42.0,领先于 Opus 4.8(40.0)、GPT 5.6 Sol(39.0)和 Fable 5(35.0)。

月之暗面还展示了 K3 在 GPU 内核优化和编译器开发方面的能力——它独立开发了一个名为 MiniTriton 的编译器,性能与 Triton 相当甚至更优。

2. 智能体(Agent)能力

K3 在 Agent 任务上的表现尤为突出。根据 BenchLM 的数据,K3 在 Agentic 类别平均得分 91.2,大幅领先 DeepSeek V4 Pro Max(74.5)。在 BrowseComp 网页浏览任务中,K3 得分 91.2%

3. 知识推理

  • GPQA 基准:得分 93.5%,高于 DeepSeek V4 Pro Max 的 90.1%

  • HLE(Humanity's Last Exam):得分 56%,显著高于 DeepSeek V4 Pro Max 的 37.7%

四、Kimi K3 的 Agent 生态

K3 不仅是更强的大模型,更是 Kimi Agent 生态的核心驱动力。基于 K3 的 Kimi Agent 具备以下能力:

能力

说明

网站生成

从需求直接生成并部署响应式 Web 应用

文档处理

编辑和生成 Word、PDF、Markdown 等多种格式

数据分析

Excel/CSV 数据分析与可视化

幻灯片

自动生成 PPT 演示文稿

Deep Research

生成万字以上的深度研究报告

Agent Swarm

最多 300 个子 Agent 并行工作

Kimi Claw

5000+ 技能的云端自动化能力

K3 驱动的 Agent 工作流程包含:任务规划 → 工具调用 → 自主执行 → 错误处理 → 交付成果,整个流程无需人工介入即可完成。

五、开源的意义与影响

全球最大开源模型

Kimi K3 是首个达到 2.8 万亿参数规模的开源模型。在过去 12 个月中的 9 个月里,Kimi 模型都保持着开源模型的规模上限,这是对"开源路线"的持续践行。

中国 AI 的差异化路径

K3 的发布代表了中国大模型产业走出了一条不同于海外的差异化路径——以开源共享拓宽产业边界,以底层效率创新破解算力约束。正如北京中关村学院院长刘铁岩所言:"技术的生命力在于开放流动,一批中国开源大模型从'单点亮相'走向'群体突破'。"

商业与开源的平衡

值得注意的是,K3 的 API 定价并不低——输出价格为 $15/MTok,与 GPT-5.6 Sol 等海外头部模型看齐。月之暗面企业业务负责人黄震昕明确表示:"国产大模型不该被贴上低价标签,我们做出了 SOTA 级模型,也能匹配合理商业定价。"

六、如何体验 Kimi K3?

K3 已经通过多种渠道开放使用:

  • Web 端:访问 kimi.com,选择 K3 或 K3 Swarm 模型

  • 移动端:更新 Kimi App(iOS / Android / HarmonyOS)切换至 K3 模型

  • Kimi Work:下载最新桌面版(v3.1.0+)

  • Kimi Code:终端中运行 /model 命令选择 K3

  • API 调用:登录 Kimi API 平台,选择 kimi-k3 模型

完整模型权重将于 2026 年 7 月 27 日 正式开放。

写在最后

Kimi K3 的发布无疑是大模型开源社区的一个里程碑。2.8 万亿参数、原生视觉、百万 token 上下文、登顶编程榜单——这些标签背后,是月之暗面在底层架构、训练方法、工程组织上的系统性突破。

对于开发者、研究者和企业用户来说,K3 的开源意味着可以在自己的场景中部署、微调、探索这个接近前沿闭源模型能力的大型模型。而它所引发的"算力挤兑"——发布后因涌入量过大一度暂停新用户注册——也从侧面印证了其强大的吸引力。

从 K2 到 K2.5、K2.6,再到如今的 K3,Kimi 模型的迭代速度和质量令人印象深刻。开源大模型的"天花板"正在被不断刷新,而这一次,中国团队走在了最前面。


参考来源:新华社、月之暗面官方博客、Kimi API 平台、每日经济新闻、经济日报等

WorkBuddy + Skills 让你的考试认证全流程自动化 2026-07-22
WAIC 2026 总结与展望:从「模型竞赛」到「产品落地」 2026-07-23

评论区