7.1
深览指数
产品腾讯新闻·量子位··AI 生成
GPT-5.6今起大降价,最大幅度80%
OpenAI 宣布 GPT-5.6 系列模型大幅降价,入门款 Luna 降幅高达 80%,主力模型 Terra 降价 20%,旗舰 Sol 维持原价但推出速度提升 2.5 倍的 Fast mode。文章核心揭示了降价背后的驱动力:GPT-5.6 Sol 模型自身参与了生产系统的优化,通过重写 GPU Kernel 和优化推测解码,将端到端服务成本降低了 20% 以上。文章还指出,降价尤其指向降低 Agent 工作流的高频调用成本,并提出了一个“模型提效→降价→更多应用→进一步提效”的降价飞轮逻辑。适合关注 AI 模型商业化、API 定价策略和 Agent 技术落地的从业者阅读。原文 ↗
核心观点
- ▍OpenAI 对 GPT-5.6 系列大幅降价的核心驱动力是模型自身参与生产系统优化所带来的效率提升,而非单纯的市场竞争。
- 01GPT-5.6 Luna 模型降价幅度最大,每百万 Token 输入价格从 1 美元降至 0.2 美元,降幅 80%。
- 02GPT-5.6 Terra 模型降价 20%,输入和输出价格分别降至 2 美元和 12 美元。
- 03旗舰模型 GPT-5.6 Sol 保持原价,但新增了 Fast mode,速度最高可达标准模式的 2.5 倍,价格为标准模式的 2 倍。
- 04GPT-5.6 Sol 参与了自身生产系统的优化,包括重写和优化 GPU Kernel,使端到端服务成本下降 20%。
- 05GPT-5.6 Sol 改进了推测解码技术,使 Token 生成效率提升 15% 以上。
- 06OpenAI 将 ChatGPT 和 Codex CLI 中的 Auto-review 模型从 GPT-5.4 升级为 GPT-5.6 Luna,预计成本将降至原来的约十分之一。
- 07降价后的 GPT-5.6 Luna 被定位为面向成本敏感型工作负载的模型,支持工具调用、长上下文和多步工作流,意图降低 Agent 长期运行的门槛。
反方 / 局限
- — 文章指出,GPT-5.6 的自我优化并非完全自主,整个过程仍由人类主导,包括目标设定、结果验证和代码上线等环节(Human in the Loop)。
7 分钟 · 4 卡片 · 11 资料
读原文 →