3.4
深览指数
科技微博·量子位··AI 生成

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴发布新基座大模型Qwen3.8-Max,总参数量2.4万亿,在编程、长文本分析、多模态理解等任务上表现突出,部分基准测试超过Claude Opus 5和Fable 5。价格仅为海外竞品(Opus 5)的24%-40%。文章通过实测案例展示了模型在端到端编程交付、跨文档交叉分析、长视频内容理解方面的能力,但缺乏独立第三方验真和与竞品直接对比的原始数据,本质上是一篇PR软文。适合对AI大模型市场动态和产品能力有持续关注的读者快速了解,但不应作为独立决策依据。原文 ↗

核心观点
  • Qwen3.8-Max是阿里最新发布的2.4万亿参数基座大模型,在编程、长文本分析、多模态理解等任务上达到全球第一梯队,且价格仅为海外竞品(Opus 5)的24%-40%。
  1. 01在第三方权威榜单Arena中,Qwen3.8-Max在文本能力榜单上表现直逼Claude系列模型,编程能力超过Claude Opus 5和Fable 5的High版本。
  2. 02国内定价:每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元;国际价格仅为Opus 5的40%与24%。
  3. 03实测中,Qwen3.8-Max能从零完成一个复杂AI资讯网站的端到端开发,包括需求拆解、技术选型、项目结构、功能实现、问题解决和功能验收。
  4. 04Qwen3.8-Max能对几十页论文(含正文、图表、附录)进行跨章节交叉分析,正确回答关于ILSVRC和PASCAL VOC难度对比的复杂问题。
  5. 05能够处理近70分钟视频播客,自动生成按话题划分的核心观点时间轴,并定位原始片段。
  6. 06阿里自2023年开源至今已累计开源400多个模型,衍生模型超20万个,累计下载量突破10亿次。
反方 / 局限
  • 文章所有测试均由作者自行操作,缺乏独立第三方验真,结果可能存在选择性呈现或环境偏差。
  • 提及的Arena榜单未交代具体评测日期、版本号和详细方法论,无法确认其权威性和时效性。
  • 全文未提及模型在推理、安全性、偏见、幻觉控制等维度上的表现,也未与OpenAI、Google等同期竞品进行系统横向对比。
11 分钟 · 5 卡片 · 15 资料
读原文 →

概念锚点

前置背景

平行视角

未来推演

延伸追问