5.9
深览指数
科技智东西··AI 生成
刚刚,Kimi K3开源!2.8万亿参数砸向全球,硅谷巨头看傻了
月之暗面于7月28日开源其2.8万亿参数MoE模型Kimi K3的权重、技术报告及关键Infra技术(MoonEP、FlashKDA、AgentEnv)。文章汇集了Hugging Face CEO、Cognition等海外机构及开发者的正面评价,并展示了Kimi K3在编程、Agent、视觉等多项基准测试中对标甚至超越GPT-5.6 Sol与Claude Fable 5的表现。文章后半部分指出,Kimi K3的开源热度已引发美国议员提案扩大商务部权限以限制中国AI技术,但近200家美国初创企业反对此举,凸显了技术封锁与市场力量之间的张力。适合关注大模型前沿动态、开源生态及中美AI政策博弈的读者。原文 ↗
核心观点
- ▍Kimi K3开源标志着中国开源模型已从‘又一个中国模型’转变为全球开发者眼中的前沿工具,其性能在某些基准测试中超越了GPT-5.6 Sol和Claude Fable 5。
- 01Kimi K3是一个拥有2.8万亿参数的混合专家(MoE)模型,支持原生视觉理解和100万token上下文窗口。
- 02月之暗面开源了三大Infra技术:为细粒度MoE设计的通信库MoonEP、高性能算子FlashKDA(在H20上prefill速度提升1.72-2.22倍),以及Agent训练沙箱系统AgentEnv。
- 03在编程测试中,Kimi K3在SWE Marathon、Program Bench取得第一,Terminal Bench 2.1达到88.3分,FrontierSWE中以81.2分位列第二,仅次于Claude Fable 5。
- 04在Agent和知识工作场景中,Kimi K3在BrowseComp(91.2分)、Automation Bench、SpreadsheetBench 2等测试中取得领先,但在GDPval-AA v2、APEX-Agents等综合办公任务中仍弱于Claude Fable 5。
- 05Kimi K3的调用成本为0.03美元,远低于Fable 5的0.38美元和GPT-5.6 Sol的0.11美元。
- 06海外AI基础设施厂商Nebius、Baseten、Fireworks等宣布Day 0适配Kimi K3,华为昇腾CANN也宣布原生支持MXFP4量化。
- 07美国参议员蒂姆·斯科特和比尔·哈格蒂已提案扩大商务部权限以限制外国对手接触AI技术,白宫曾考虑通过行政令要求使用中国模型的美国企业对安全事件承担责任。
反方 / 局限
- — 在综合白领任务GDPval-AA v2、APEX-Agents等更贴近真实办公流程的评测中,Kimi K3仍弱于Claude Fable 5等顶级闭源模型。
- — 在部分视觉推理任务中,Kimi K3仍存在差距,例如零样本视觉工具任务Zerobench低于Claude Fable 5。
- — 文章所引用的评测数据主要来自Kimi官方,且部分测试(如Internal Knowledge Work Bench)为内部测试,缺乏第三方独立验证。
月之暗面Kimi K3Clem DelangueHugging FaceCognitionOsmanticAINebiusBasetenFireworks华为昇腾Claude Fable 5GPT-5.6 SolMoonEPFlashKDAAgentEnv蒂姆·斯科特比尔·哈格蒂
16 分钟 · 4 卡片 · 12 资料
读原文 →