公司动态
Kimi K3来了:2.8万亿参数全球最大开源模型,凭什么正面硬刚Fable 5和GPT-5.6
一句话说清楚Kimi K3是什么2026年7月16日WAIC 2026世界人工智能大会前夕月之暗面Moonshot AI正式发布新一代旗舰模型Kimi K3——总参数规模达2.8万亿是目前全球参数规模最大的开源模型也是全球首个逼近3万亿参数级别的开源大模型。模型已同步上线Kimi.com、Kimi Work、Kimi Code桌面客户端以及API完整权重计划于2026年7月27日前向开源社区发布。需要注意一个容易被忽略的细节目前只是宣布开源权重文件还没真正放出来7月16日发布当天只能通过官方API、OpenRouter和消费级App访问还不能git clone下来本地跑。真正意义上的完整开源要等7月27日。核心技术规格总参数2.8万亿采用MoE混合专家架构896个专家中每次仅激活16个上下文窗口100万token相当于一次能读入一整本教科书体量的文字核心架构基于自研的KDA混合线性注意力机制Kimi Delta Attention和Attention Residuals注意力残差技术构建KDA机制可实现长文本场景下最高6.3倍的解码加速Attention Residuals带来约25%的训练效率提升且额外成本控制在2%以内多模态能力原生支持视觉理解能处理文本、图像、视频输入定位场景面向长程编程、知识工作、深度研究等复杂任务场景专项优化且默认启用边想边做的max思考模式跑分表现全球第四但细分场景做到第一第三方评测机构Artificial Analysis给出的Intelligence Index综合智能指数上K3拿到57分排名全球第四落后于Claude Fable 5和GPT-5.6 Sol但已经超过了Claude Opus 4.8。不过在细分场景上K3打出了几个全球第一Arena前端代码竞技场Frontend Code Arena以1679分登顶超越Claude Fable 5BrowseComp跑出91.2分、Terminal Bench 2.1跑出88.3分、ProgramBench跑出77.8分在14项测试中击败GPT-5.6 Sol达11项全面击败Opus 4.8月之暗面官方也很坦诚地表示K3整体表现仍落后于目前最强的闭源模型但在部分前沿任务上已经建立起稳定优势。定价一反常态的贵月之暗面一直以低价开源著称但这次K3的定价打破了这个印象。国际站API定价为每百万输入token 3美元、输出15美元缓存命中低至0.3美元国内Kimi开放平台则是每百万token输入2元缓存命中/20元未命中输出100元。对比一下就能看出差距有多大DeepSeek V4-Pro和小米MiMo-V2.5-Pro输出价格仅为6元/百万tokenZ.ai的GLM-5.2是28元阿里通义千问3.7-Max是36元——K3的100元定价是这些友商的好几倍。当然放到全球坐标下看K3依然比Claude Fable 5便宜不少——Fable同等输出量要50美元。借助Mooncake分离式推理架构官方API编程场景下的缓存命中率超过90%实际输入成本只有标准价的四分之一。上线首日就被限流了一个挺有意思的现象K3上线48小时内需求就超过了月之暗面的GPU算力储备官方从7月19日开始暂停了新的付费订阅注册——这倒是从侧面说明了这次发布的热度确实不小。开发者最该关注的3个点权重还没完全放出来7月16日发布的是承诺开源7月27日才是真正能下载权重、本地部署的时间点目前只能通过API使用兼容OpenAI SDKK3的API接口设计兼容OpenAI SDK规范已经在用GPT系列工具链的团队接入成本较低量化训练细节从SFT阶段就引入了量化感知训练采用MXFP4权重和MXFP8激活函数以兼容更广泛的硬件同时引入完全平衡的专家并行训练方法避免大规模专家并行训练时的吞吐量下降写在最后Kimi K3的发布再次印证了一个趋势中美前沿模型之间的差距正在被持续压缩。有评测平台负责人评价称这可能是今年最重要的一次发布标志着开源中国模型正在超越闭源美国模型的某些能力边界。7月27日权重全量开放后才是真正检验这款模型能不能被开发者社区广泛落地的时刻值得持续关注。