7.7
深览指数
科技腾讯新闻·字母榜··AI 生成

大模型长假静悄悄

2024年十一长假期间,国内主流大模型厂商集体缺席了以往的“假期发模型”竞赛,没有任何旗舰模型的扎堆发布,与去年春节和国庆的激烈发布形成鲜明对比。文章指出,虽然新模型静悄悄,但DeepSeek、智谱、月之暗面、腾讯等公司在算力基建、Agent工具链、商业化部署和资本运作上并未停歇。作者分析,这并非工程师度假,而是行业竞争重心从“卷模型参数”向Agent、产品化、商业化转移的信号,同时也面临旗舰模型提升难度加大的瓶颈。适合关注中国AI产业竞争格局与战略重心的读者。原文 ↗

核心观点
  • ▍2024年十一长假国内大模型厂商集体未发布旗舰新模型,与之前春节、十一的扎堆发布形成鲜明对比,标志着行业竞争节奏的转变。
  • ▍行业竞争重心正从单纯的模型参数军备竞赛,向Agent工具链、产品化、商业化部署和算力基建等更具实用性的方向转移。
  1. 012024年十一期间,DeepSeek连续推出Harness v0.2.1-alpha.1(支持Claude Code Mods兼容)、开源面向华为昇腾芯片的底层计算通信组件(DeepGEMM-Ascend等)。
  2. 02智谱在10月5日将其GLM-5.3模型上线AWS的Amazon Bedrock,拓展海外企业客户。
  3. 03路透社报道DeepSeek正在筹资超过800亿元(最高1000亿元),目标估值约5000亿元;彭博社报道月之暗面(Kimi)完成上市前最后一轮私募融资,估值约500亿美元,计划最快2027年在港上市。
  4. 04《金融时报》披露腾讯与甲骨文签订约70亿美元、为期五年的海外算力租赁协议,涉及约10万颗先进AI芯片;彭博社称腾讯正考虑发行最多50亿美元离岸债券用于AI基础设施建设。
  5. 05阿里在云栖大会公布自研AI芯片真武V900,计划2032年将数据中心运营容量扩展至20GW以上;字节在9月初筹集296亿美元银团贷款用于AI投资。
  6. 06与2023年十一(DeepSeek V3.2-Exp、智谱GLM-4.6等发布)和2024年春节(DeepSeek R1、阿里Qwen2.5-Max、智谱GLM-5、MiniMax M2.5等密集发布)形成对比,十一期间仅MiniMax在节前上线了M3.1-Flash-Preview。
  7. 07文章列举了自上次旗舰发布以来的时间线:阶跃Step 5 Preview(9月20日)、小米MiMo-V2.6(9月22日)、DeepSeek V4.1-Flash(9月10日,但Pro版未发布)、智谱GLM-5.3(8月14日),月之暗面Kimi K3(7月中旬),字节Seed2.1系列(6月),腾讯混元Hy4 Preview(8月底)。
反方 / 局限
  • — 文章承认,模型发布节奏放缓也可能只是因为研发周期与节假日不匹配的巧合,以及旗舰模型提升难度加大(参数增加、成本上升但跑分提升有限),并非有意为之的战略转移。
  • — 作者指出,国内AI厂商的竞争重心转移可能是“未必是坏事”,但模型能力仍是智能的基础,面临海外Claude、GPT、Gemini、Grok的持续更新,国内厂商需警惕被重新拉开距离。
13 分钟 · 4 卡片 · 10 资料
读原文 →

前置背景

平行视角

未来推演

延伸追问