← 回總覽

GPT-5.6 今起大降价,最大幅度 80%!

📅 2026-07-31 11:01 听雨 人工智能 2 分鐘 1258 字 評分: 82
LLM AI模型 价格策略 Agent工作流 GPU优化
📌 一句话摘要 OpenAI 将 GPT-5.6 系列模型大幅降价,Luna 降 80% 至每百万 Token 0.2 美元输入,背后是 Sol 模型的 GPU Kernel 与推测解码优化,旨在降低 Agent 工作流成本。 📝 详细摘要 文章报道 OpenAI 对 GPT-5.6 三款模型的最新定价调整:入门款 Luna 价格从 1 美元/百万 Token 降至 0.2 美元,输出从 6 美元降至 1.2 美元,降幅达 80%;中端 Terra 降价 20%;旗舰 Sol 维持原价但推出 2.5 倍速的 Fast mode。降价原因归因于 Sol 在生产系统中的 GPU Kernel

📌 一句话摘要

OpenAI 将 GPT-5.6 系列模型大幅降价,Luna 降 80% 至每百万 Token 0.2 美元输入,背后是 Sol 模型的 GPU Kernel 与推测解码优化,旨在降低 Agent 工作流成本。

📝 详细摘要

文章报道 OpenAI 对 GPT-5.6 三款模型的最新定价调整:入门款 Luna 价格从 1 美元/百万 Token 降至 0.2 美元,输出从 6 美元降至 1.2 美元,降幅达 80%;中端 Terra 降价 20%;旗舰 Sol 维持原价但推出 2.5 倍速的 Fast mode。降价原因归因于 Sol 在生产系统中的 GPU Kernel 优化和推测解码提升,使整体服务成本下降约 20%。文章进一步解释了这些技术改进对成本的影响,并指出降价将降低 Agent 工作流的运行门槛,促进高频、成本敏感型任务的大规模使用。

💡 主要观点

- Luna 降价 80%,输入成本降至每百万 Token 0.2 美元。 降价后 Luna 与上一代 GPT-5.4 nano 的输入价格持平,输出甚至更便宜,定位为成本敏感型高频任务模型。

降价背后是 Sol 模型的系统优化。 Sol 重写 GPU Kernel 并采用推测解码,使端到端服务成本下降约 20%,进而转化为价格表上的折扣。
价格下降降低了 Agent 工作流的门槛。 更低的调用成本让高频审查、监控等任务可以常规化,推动模型使用规模扩大,形成新的效率提升循环。
Fast mode 为 Sol 提供 2.5 倍加速,但费用为标准模式的两倍。 用户可在对时效有更高要求时付费换取更快响应,保持模型能力不变。

💬 文章金句

- GPT-5.6 Sol 参与自身改进,效率取得了飞跃式提升,故特此回馈新老用户。

  • 模型参与提高运行效率,成本下降;价格降低后,模型进入更多高频工作流;调用规模扩大,再推动下一轮效率优化。
  • OpenAI 表示,降价是因为 GPT-5.6 Sol 自己帮自己省了钱。

📊 文章信息

AI 初评:82

来源:量子位

作者:听雨

分类:人工智能

语言:中文

阅读时间:9 分钟

字数:2015

标签: LLM, AI模型, 价格策略, Agent工作流, GPU优化

阅读完整文章

查看原文 → 發佈: 2026-07-31 11:01:21 收錄: 2026-07-31 16:00:36

🤖 問 AI

針對這篇文章提問,AI 會根據文章內容回答。按 Ctrl+Enter 送出。