科技 智东西 · 江 宇 · 2小时前 · AI 生成
OpenAI突然宣布:GPT-5.6大幅降价,2折起售 OpenAI 于 2026 年 7 月 31 日宣布下调 GPT-5.6 系列模型 API 价格:Luna 降幅达 80%,Terra 降 20%,旗舰 Sol 新增 Fast 模式(2.5 倍推理速度,价格翻倍)。降价前一天,OpenAI 披露 Sol 已用于优化自身推理系统,使服务成本降 20%、Token 生成效率提升 15% 以上。此举将效率提升直接反馈给开发者,并在价格-性能图上与 Claude Opus 5、DeepSeek V4 Pro 等竞品公开对标,表明大模型竞争正从“拼能力”转向“拼智能比”。适合关注 AI 模型定价策略、开发者生态及市场竞争的技术从业者或投资者阅读。原文 ↗ 原文 ↗
核心观点
▍ OpenAI 正在将模型自身效率提升的收益直接转化为降价,大模型竞争从“拼能力上限”转向“拼智能比”(Price/Intelligence Tradeoff)。 01 GPT-5.6 Luna API 价格下调 80%,输入降至每百万 Token 0.2 美元,输出降至 1.2 美元。 02 GPT-5.6 Terra 价格下调 20%,调整后输入每百万 Token 2 美元,输出 12 美元。 03 GPT-5.6 Sol 价格不变,但新增 Fast 模式,推理速度可达标准模式的 2.5 倍,价格为标准模式两倍。 04 降价前一天,OpenAI 披露 Sol 已用于自主重写生产 GPU Kernel、设计实验、监控训练,使服务成本降低 20%,Token 生成效率提升 15% 以上。 05 OpenAI 公布价格-性能分布图,对比显示 Luna 智能指数超 50,单次任务成本约 0.05 美元,优于 Claude Opus 5、Gemini 3.6 Flash 等竞品。 反方 / 局限
— 有开发者指出,Luna 发布后从未被使用过,且若未来不能接近 Sol 的智能水平,降价对“智能便宜到无需计量”的愿景贡献有限。 10 分钟 · 4 卡片 · 11 资料
读原文 →
前置背景 智能指数榜:OpenAI 的定位真相
文章引用的 Artificial Analysis Intelligence Index v4.1 榜单,最新数据(2026年7月26日)显示:榜首是 Claude Opus 5(max)61分,GPT-5.6 Sol(max)以 59 分排第 4。Luna 此次降价 80% 后,其智能指数约 50 分,落在图中『单次任务成本 0.05 美元』区域。这意味着,Luna 的卖点不是最强,而是『用 50 分的智能,花 0.05 美元』——在成本敏感型任务上,比竞品(如 Gemini 3.6 Flash 或 GLM-5.2 Max)提供更优的『智能/美元』比,而非单纯低价。
▸ 3 条关联资料
▼
平行视角 AI阵营的『智能比』路线分化
OpenAI 降价打响的是『智能比』战争,但竞品并未全面跟进。Anthropic 走溢价路线,Claude Fable 5 定价输入 10 美元、输出 50 美元,比前代 Opus 输出价高出 200%,专注高价值科研任务;DeepSeek 则走极致性价比路线,V4-Pro 永久降价 75%,缓存命中输入低至 0.025 元/百万 Token。三条路线——OpenAI 的全档位分层覆盖、Anthropic 的奢侈品化、DeepSeek 的平民化——本质是对『智能比』定义权的争夺,而非简单的价格战。
▸ 3 条关联资料
▼
未来推演 开发者的『多模型路由』时代
OpenAI 降价直接冲击了企业 API 市场格局——2026年5月 Anthropic 企业 API 份额一度反超 OpenAI 达 34.4%。降价后,开发者核心策略正在从『绑定单一模型』转向『多模型路由』:轻量任务走 Luna,日常开发走 Terra,复杂推理走 Sol 或 Claude Opus 5。这种『分层路由』架构意味着,模型厂商的竞争不再是『全胜』,而是『争取进入路由表』。下一个关键变量是:谁能提供最省心的『路由 SDK』,谁能把『智能比』做成可编程的 API 定价函数。
▸ 2 条关联资料
▼
延伸追问 『自优化』正循环能持续多久?
文章披露 GPT-5.6 Sol 已被用于优化自身推理系统,使服务成本降 20%、Token 生成效率提升 15%。这开启了『模型越强→优化越快→成本越低→用户越多→数据越多→模型更强』的正循环。但关键问题是:这个正循环的上限在哪?推理优化技术(推测解码、GPU Kernel 重写、KV 缓存)的边际收益已经递减,下一轮 20% 的降本空间在哪?如果 Sol 优化能力达到瓶颈,OpenAI 的『智能比』优势是否会立刻被竞品追平?
▸ 3 条关联资料
▼