AI 快讯 编译自 simon_willison #模型发布#开源模型#Kimi K3

月之暗面发布Kimi K3:2.8万亿参数开源模型,性能超越GPT-5.5,定价对标Claude Sonnet

月之暗面发布Kimi K3,2.8万亿参数开源模型,性能超越GPT-5.5和Claude Opus 4.8,但落后于Claude Fable 5。定价$3/$15每百万token,为国内最贵模型。中文用户关注:能否平替GPT?开源权重即将发布。

编译发布 2026/07/16 原文发布 2026/07/16

一句话看懂

月之暗面发布Kimi K3,2.8万亿参数开源模型,性能超越GPT-5.5和Claude Opus 4.8,但落后于Claude Fable 5,定价$3/$15每百万token,承诺7月27日开源权重。

详细发生了什么

7月16日,中国AI公司月之暗面(Moonshot AI)发布Kimi K3,自称“最强大模型”,参数规模2.8万亿,号称首个“开源3T级模型”(2.8万亿向上取整)。自测基准显示,K3在多数任务上击败Claude Opus 4.8 max和GPT-5.5 high,但不及Claude Fable 5和GPT-5.6 Sol。

第三方评测机构Artificial Analysis报告亮点:

  • 在长时知识工作评估中,Kimi K3 Elo得分1547,比K2.6提升732分,仅次于Claude Fable 5。
  • 每任务成本$0.94,接近GPT-5.6 Sol的$1.04,约为Opus 4.8($1.80)的一半,但高于其他开源模型。
  • 输出token使用量比K2.6减少21%。

此外,Kimi K3在Arena.ai的Frontend Code排行榜上登顶,超越Claude Fable 5。定价方面,输入$3/百万token,输出$15/百万token,与Anthropic的Claude Sonnet系列持平,成为国内AI实验室最贵模型,较K2.6($0.95/$4)大幅上涨。

中文圈视角

国内用户用得上吗? 目前可通过Kimi官网和API使用,无需特殊网络。但API定价$3/$15每百万token,对个人开发者偏贵,适合企业级应用。开源权重承诺7月27日发布,届时可本地部署,但2.8万亿参数对硬件要求极高(估计需多卡A100/H100集群),普通用户难以本地运行。

国产同类对比: 相比DeepSeek V4 Pro(1.6T参数,开源),Kimi K3参数翻倍,性能更强但价格更高。DeepSeek API定价约$0.5/$2,性价比突出。Kimi K3定位高端,对标GPT-5.5和Claude Opus,适合对质量要求极高的场景(如复杂代码生成、长文档分析)。

中文场景影响: 月之暗面在长上下文处理上有积累,K3可能延续K2的200万token context window,对中文长文档、科研论文分析有优势。但定价偏高,可能限制普及。开源后,国内开发者可微调用于垂直领域,但算力成本是门槛。

监管/合规: 开源模型需注意内容安全,月之暗面作为中国公司,需遵守国内AI法规。开源权重发布后,第三方部署可能面临审核要求。

几条值得记住的细节

  • 参数规模2.8万亿,是DeepSeek V4 Pro(1.6T)的1.75倍。
  • 开源权重承诺7月27日发布,可在Hugging Face等平台获取。
  • 在Frontend Code排行榜上超越Claude Fable 5,代码能力突出。
  • 输出token使用量比K2.6减少21%,效率提升。
  • 定价$3/$15每百万token,为国内最贵API模型。

一句话总结

Kimi K3性能跻身第一梯队但价格昂贵,开源后能否成为国产AI新标杆,取决于社区适配和算力成本。