Kimi K3模型发布与技术架构

Moonshot AI(月之暗面)于2026年7月16日正式发布了Kimi K3模型。该模型被定义为国内首款总参数量达2.8万亿的MoE(稀疏混合架构)开源旗舰大模型,其中包含896个专家模块,单次推理仅激活16个专家,旨在提升算力利用率。K3在技术上采用了自研的Kimi Delta Attention混合线性注意力与Attention Residual残差优化,使其长文本扩展效率较K2提升2.5倍。

在功能特性方面,K3支持原生无损的1,048,576 Token上下文窗口,且无虚拟拉伸压缩。该模型内置视觉编码器,可解析截图、PDF图纸、Figma设计稿等多模态输入。此外,K3仅提供Max深度思考档位,全程自动进行深度推理。

市场定位与定价策略

Kimi K3的定价策略反映了Moonshot将其从中端性价比重新定位为前沿智能的市场策略。根据官方定价文档及独立验证,K3的费率结构如下:输入缓存未命中为每百万Token 3.00美元,输入缓存命中为每百万Token 0.30美元,输出Token为每百万Token 15.00美元。

这一价格体系明显高于上一代Kimi K2.6(K2.6输入为0.60美元/百万,输出为2.50美元/百万),目前与Anthropic的Claude Sonnet处于同一档位。值得注意的是,K3对完整100万Token的上下文窗口实行统一定价,不随长度分级收费。

性能表现与行业评价

在性能测评方面,Kimi K3在多个主流编程和智能体基准中与Claude Fable 5和GPT-5.6 Sol达到可比区间。在第三方评估平台Code Arena上,K3的编程能力位列第一,是首个在该榜单上超越闭源模型的开源模型。在Artificial Analysis平台上,其排名全球第三。

针对实际应用,TalkMe CEO贾子健指出,K3的前端渲染能力出色,但在后端编程能力上与DeepSeek V4 Pro基本相当。他认为,虽然K3在多项测评中表现优秀,但对于仅需简单任务的普通用户而言,可能无法触碰到该模型的能力边界。