OpenAI 将 GPT-5.6 系列模型大幅降价,Luna 降 80% 至每百万 Token 0.2 美元输入,背后是 Sol 模型的 GPU Kernel 与推测解码优化,旨在降低 Agent 工作流成本。
📝 详细摘要
文章报道 OpenAI 对 GPT-5.6 三款模型的最新定价调整:入门款 Luna 价格从 1 美元/百万 Token 降至 0.2 美元,输出从 6 美元降至 1.2 美元,降幅达 80%;中端 Terra 降价 20%;旗舰 Sol 维持原价但推出 2.5 倍速的 Fast mode。降价原因归因于 Sol 在生产系统中的 GPU Kernel 优化和推测解码提升,使整体服务成本下降约 20%。文章进一步解释了这些技术改进对成本的影响,并指出降价将降低 Agent 工作流的运行门槛,促进高频、成本敏感型任务的大规模使用。
💡 主要观点
- Luna 降价 80%,输入成本降至每百万 Token 0.2 美元。 降价后 Luna 与上一代 GPT-5.4 nano 的输入价格持平,输出甚至更便宜,定位为成本敏感型高频任务模型。
💬 文章金句
- GPT-5.6 Sol 参与自身改进,效率取得了飞跃式提升,故特此回馈新老用户。
- 模型参与提高运行效率,成本下降;价格降低后,模型进入更多高频工作流;调用规模扩大,再推动下一轮效率优化。
- OpenAI 表示,降价是因为 GPT-5.6 Sol 自己帮自己省了钱。
📊 文章信息
AI 初评:82
来源:量子位
作者:听雨
分类:人工智能
语言:中文
阅读时间:9 分钟
字数:2015
标签: LLM, AI模型, 价格策略, Agent工作流, GPU优化