7月16日,中国人工智能公司月之暗面正式发布新一代开源基础模型Kimi K3,参数规模高达2.8万亿,同步上线API服务及开发者文档。据新华社报道,Kimi K3综合智能水平已接近全球前沿闭源模型,成为目前全球参数规模最大的开源模型,标志着我国大模型发展迈出关键一步。
Kimi K3是月之暗面迄今最强旗舰模型,专为长程智能体编程与自我演进工作流设计。其核心技术包括自研的Kimi Delta Attention(KDA)混合线性注意力机制和Attention Residuals(AttnRes)结构,显著优化了长序列信息处理与深层网络信息传递效率。
该模型支持100万Token上下文窗口,并原生集成视觉理解能力,适用于软件工程、知识工作及复杂推理等高难度场景。月之暗面表示,KDA技术在百万级上下文中实现高达6.3倍的解码加速,而AttnRes机制仅增加不到2%的计算成本,即可提升约25%的训练效率。
Kimi K3采用高稀疏度的MoE架构,拥有896个专家模块,每次推理仅激活16个,在扩大模型容量的同时有效控制计算开销。模型重点强化“智能体编程”(Agentic Coding)能力,可理解大型代码库、调用工具、执行测试并根据反馈动态调整任务策略。
与上一代模型相比,Kimi K3更强调从“回答问题”向“完成任务”转变。在游戏开发、前端工程、CAD设计和基础设施优化等长周期任务中,模型能融合代码、运行日志、测试结果及视觉信息进行综合决策。
性能评测显示,Kimi K3在多个维度跻身全球第一梯队。社区整理的GDPval-AA v2知识工作评测中,Kimi K3得分1687,超过Anthropic的Claude Opus 4.8 Max(1600分),仅次于Claude Fable 5 Max和GPT-5.6 Sol Max。在AA-Briefcase智能体测试中,K3以1527分位列第二,超越GPT-5.6 Sol Max。
在长上下文检索能力方面,Kimi K3于BrowseComp测试中取得91.2分,凭借百万Token原生支持,在无需上下文压缩的情况下高效完成复杂信息检索任务。
部分开发者和机构用户反馈,Kimi K3在复杂Agent任务中展现出接近顶级闭源模型的自主规划与执行能力,被称作具有“Fable级体感”。有海外对冲基金及内资银行团队测评认为,其性能已超过Claude Opus 4.8,接近Fable 5和GPT-5.6 Sol水平。
值得注意的是,Kimi K3采取开放权重路线,允许全球开发者免费下载、部署和修改,与OpenAI、Anthropic坚持的闭源API模式形成鲜明对比。此举旨在加速构建开发者生态,推动中国AI从成本优势转向能力与生态全面竞争。
发布前,Kimi K3已引发海外高度关注。金融时报援引知情人士称,该模型虽暂未超越因安全问题暂停发布的Claude Fable,但已显著缩小中美顶尖模型间的差距,挑战“中国AI落后美国8至12个月”的传统认知。
商业模式差异正成为全球AI竞争新焦点。Anthropic计划于9月将Claude Opus 4.8价格上调50%,而Kimi K3等中国开源模型推理成本仅为前者三分之一左右。随着企业日益重视AI支出控制,越来越多海外机构开始试用中国模型替代方案。
今年以来,中国头部AI公司几乎全面转向开源:DeepSeek凭借R1系列迅速获得全球关注,智谱、MiniMax等相继推出开放权重模型,月之暗面此次加入进一步强化这一趋势。相比之下,美国头部厂商仍坚守闭源策略。
金融时报指出,中美AI竞争正从单纯模型性能比拼,转向开源生态、开发者社区与商业模式的全面较量。资本市场亦在重估中国AI企业价值:月之暗面最新估值约315亿美元,DeepSeek达710亿美元,虽远低于Anthropic(9650亿)和OpenAI(8520亿),但增长势头迅猛。
随着Kimi K3正式发布,中国AI正加速融入全球技术竞争主航道,开源或将成为打破封闭生态壁垒的关键路径。