科技微博·量子位··AI 生成
刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude
阿里巴巴发布新基座大模型Qwen3.8-Max,总参数量2.4万亿,在编程、长文本分析、多模态理解等任务上表现突出,部分基准测试超过Claude Opus 5和Fable 5。价格仅为海外竞品(Opus 5)的24%-40%。文章通过实测案例展示了模型在端到端编程交付、跨文档交叉分析、长视频内容理解方面的能力,但缺乏独立第三方验真和与竞品直接对比的原始数据,本质上是一篇PR软文。适合对AI大模型市场动态和产品能力有持续关注的读者快速了解,但不应作为独立决策依据。原文 ↗原文 ↗
核心观点
- ▍Qwen3.8-Max是阿里最新发布的2.4万亿参数基座大模型,在编程、长文本分析、多模态理解等任务上达到全球第一梯队,且价格仅为海外竞品(Opus 5)的24%-40%。
- 01在第三方权威榜单Arena中,Qwen3.8-Max在文本能力榜单上表现直逼Claude系列模型,编程能力超过Claude Opus 5和Fable 5的High版本。
- 02国内定价:每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元;国际价格仅为Opus 5的40%与24%。
- 03实测中,Qwen3.8-Max能从零完成一个复杂AI资讯网站的端到端开发,包括需求拆解、技术选型、项目结构、功能实现、问题解决和功能验收。
- 04Qwen3.8-Max能对几十页论文(含正文、图表、附录)进行跨章节交叉分析,正确回答关于ILSVRC和PASCAL VOC难度对比的复杂问题。
- 05能够处理近70分钟视频播客,自动生成按话题划分的核心观点时间轴,并定位原始片段。
- 06阿里自2023年开源至今已累计开源400多个模型,衍生模型超20万个,累计下载量突破10亿次。
反方 / 局限
- — 文章所有测试均由作者自行操作,缺乏独立第三方验真,结果可能存在选择性呈现或环境偏差。
- — 提及的Arena榜单未交代具体评测日期、版本号和详细方法论,无法确认其权威性和时效性。
- — 全文未提及模型在推理、安全性、偏见、幻觉控制等维度上的表现,也未与OpenAI、Google等同期竞品进行系统横向对比。
11 分钟 · 5 卡片 · 15 资料
读原文 →概念锚点
前置背景
平行视角
未来推演
延伸追问