4.8
深览指数
科技量子位··AI 生成

阿里Qwen3.8正式发布,编程与办公再进化,推理更快更稳定

阿里巴巴发布新一代基座大模型Qwen3.8,总参数量2.4万亿,在编程(Coding)和办公(Cowork)能力上宣称有大幅提升。文章列举了多项权威榜单排名(如Arena、CodeArena)和具体评测分数,强调其编程能力已从“补全代码”进化到“自主完成十数天的项目交付”,以及办公能力在法务、金融等领域的实际应用案例。文章本质是一篇由阿里提供、量子位转载的软性产品发布稿,信息密度高但缺乏独立视角和反方观点,适合想了解Qwen3.8技术指标和官方宣传亮点的读者快速浏览。原文 ↗

核心观点
  • Qwen3.8是阿里千问系列中尺寸最大、性能最强的旗舰模型,在编程和办公能力上实现了显著进化,整体性能处于全球第一梯队。
  • Qwen3.8的编程能力已从辅助性工具(补全代码)进化为能自主完成数天、真实项目交付的智能体,具备“自主编程”能力。
  1. 01Qwen3.8总参数量2.4万亿,激活参数95B,采用稀疏MoE架构与混合注意力机制。
  2. 02在权威三方榜单Arena中,Qwen模型仅次于Anthropic的Claude系列。
  3. 03在科研复现评测PaperBench上,Qwen3.8-Max得分为93.0,较上代提升28.2分。
  4. 04Qwen3.8可从一个空文件夹出发,自主运行16天后,构建出一个名为“oh-my-cli”的自进化智能体框架,该过程已完全开源。
  5. 05Qwen3.8在办公场景示例中,法务助理团队需一周完成的法律文档标注工作,Qwen3.8一小时内完成;篮球数据分析工作中,数十分钟即可拆解160小时的比赛录像。
  6. 06Qwen3.8-Max预计下周开源,同时还将开源 Qwen3.8-27B。
  7. 07Qwen3.8 API国内定价为每百万Tokens输入12元、输出36元,隐式缓存命中1.5元,国际价格约为Opus5的40%与24%。
反方 / 局限
  • 文章为阿里提供的软性发布稿,全文未提及任何模型局限、潜在风险、与竞品的真实对比劣势或未解决的挑战,立场单一,缺乏客观性。
6 分钟 · 5 卡片 · 10 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问