月之暗面正式发布 2.8 万亿参数模型 K3,权重将于 7 月 27 日开源
Kimi 正式发布 Kimi K3 模型,该模型拥有 2.8 万亿 参数,原生支持视觉理解并具备 100 万 token 上下文窗口。模型基于
KDA和AttnRes架构,采用Stable LatentMoE在 896 个专家中激活 16 个。官方评测显示,Kimi K3整体表现仍落后于 Claude Fable 5 和 GPT 5.6 Sol,但稳定超过了其他测试模型。模型现已在 Kimi 应用、Kimi Work、Kimi Code 及 API 上线,默认思考强度为max,完整模型权重计划于 7 月 27 日前发布。
月之暗面正式推出 Kimi K3 模型。该模型总参数量达 2.8 万亿,原生支持视觉理解,并拥有 100 万 token 的上下文窗口。
架构方面,K3 基于 Kimi Delta Attention (KDA) 和 Attention Residuals (AttnRes) 构建。同时,采用 Stable LatentMoE 框架,在 896 个专家中实际激活 16 个,结合 Quantile Balancing 和 Per-Head Muon 等优化。
此外,K3 从 SFT 阶段开始采用量化感知训练,使用 MXFP4 权重和 MXFP8 激活以适配广泛硬件。
性能方面,官方评测显示 Kimi K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT 5.6 Sol,但在长程编程、知识工作和推理等前沿智能场景中展现出前沿水平,并稳定超过了其他所有被测模型。
在编码能力上,K3 能完成内核优化、从零构建 GPU 编译器 MiniTriton、3D 开放世界游戏开发及自主芯片设计等长程任务。
在知识工作上,K3 能进行端到端的研究与可视化,Kimi Work 还同步推出了小组件和看板功能。
可用性方面,Kimi K3 现已在 Kimi.com、Kimi Work 、Kimi Code 及 Kimi API 上线,当前默认思考强度为 max,后续将增加 low 和 high 模式。
API 定价为每百万tokens 缓存命中输入 ¥2、未命中输入 ¥20、输出 ¥100,官方称编程场景下 API 缓存命中率超过 90%。
官方还即将面向企业推出托管 Agent 平台 Kimi Hosted Agent。完整模型权重将于 7 月 27 日前发布,更多技术细节将随技术报告公布。
官方也指出了 Kimi K3 的局限性:若 Agent 框架未按要求回传全部历史思考内容或中途切换模型,可能导致生成质量不稳定。
在处理简单任务和模糊指令时可能过于主动而替用户做出非预期决定。
与 Fable 5 等最强闭源模型相比,K3 在用户体验上仍有一定差距。




相关链接:













