暂无菜单项

OpenAI突然宣布:GPT-5.6大幅降价,2折起售

发布于
8
GPT-5.6 Sol、Terra 与 Luna 的产品定位示意
GPT-5.6 Sol、Terra 与 Luna 的产品定位示意

OpenAI 突然下调 GPT-5.6 系列 API 价格:Luna 输入与输出价格下降 80%,Terra 下降 20%;Sol 标准价格保持不变,同时新增面向时效型任务的 Fast 模式。对于持续跑批处理、智能体和内容生产流程的团队,这不是一次简单促销,而是模型分层和成本结构的重新调整。

核心结论:Luna 现在每百万输入 Token 为 0.20 美元、每百万输出 Token 为 1.20 美元;Terra 分别为 2 美元和 12 美元。标题中的“2 折起售”只对应 Luna 降到原价的 20%,并不代表所有 GPT-5.6 模型都打 2 折。
在视频制作中使用 Codex 编写自动化脚本、整理工程或调试生产工具,可查看做视频网的 Codex 站内详情页

一、GPT-5.6 新价格到底降了多少

OpenAI 公布 GPT-5.6 降价及价格性能变化
OpenAI 公布 GPT-5.6 降价及价格性能变化

以下均为每 100 万 Token 的 API 标准价格;Sol Fast 的价格按官方“Standard 的 2 倍”计算。

模型/模式 原输入价 原输出价 新输入价 新输出价 变化
GPT-5.6 Luna $1 $6 $0.20 $1.20 下降 80%
GPT-5.6 Terra $2.50 $15 $2 $12 下降 20%
GPT-5.6 Sol Standard $5 $30 $5 $30 不变
GPT-5.6 Sol Fast $10* $60* 最高 2.5 倍速度,价格为 Standard 的 2 倍
* Sol Fast 表中的 10/60 美元是按 Standard 价格的 2 倍换算。官方描述为最高达到 Standard 的 2.5 倍速度,实际吞吐仍会随任务、上下文长度和负载变化,不应理解为每个请求都固定快 2.5 倍。
Sam Altman 对模型智能与使用成本关系的表述
Sam Altman 对模型智能与使用成本关系的表述

OpenAI 同时表示,ChatGPT Work 与 Codex 订阅价格和额度预算没有调整,但 Terra 与 Luna 会消耗更少的 Credits。这意味着订阅用户未必看到月费变化,却可能在相同额度内完成更多低成本任务。Sol 原有 Priority Processing 请求将向后兼容 Fast 模式。

二、0.075 美元完成一次任务,应当怎样理解

价格性能图把 Luna 放在约 51.2 的 Intelligence Index,并估算单项任务成本约为 0.075 美元。这个数字来自特定基准中对模型完成任务的估算,适合观察相对性价比,但不是每次真实 API 调用的固定账单

实际费用仍由输入长度、输出长度、推理量、缓存命中率、工具调用轮数和失败重试共同决定。例如一个月累计使用 1000 万输入 Token 和 200 万输出 Token,Luna 新价格约为 4.4 美元,原价格约为 22 美元;Terra 新价格约为 44 美元,原价格约为 55 美元。两者恰好对应 80% 和 20% 的降幅。

GPT-5.6 Sol 在推理系统中的效率优化数据
GPT-5.6 Sol 在推理系统中的效率优化数据

三、降价来自哪里:模型与推理系统一起优化

OpenAI 给出的解释不是单纯让模型少思考,而是同时优化模型、推理栈和智能体 Harness。GPT-5.6 Sol 参与改进生产 GPU 内核,使端到端服务成本降低 20%;推测解码方面的改进,又让 Token 生成效率提升超过 15%。这些工程收益最终为价格下降留下空间。

GPT-5.6 从智能体编排到 GPU 推理的全栈效率优化
GPT-5.6 从智能体编排到 GPU 推理的全栈效率优化

从本地智能体编排、CPU 侧 API 调度,到 GPU 上的 KV Cache、内存管理、内核和推测解码,每一层的小幅节省会在大规模请求中累积。对企业用户而言,价格下降能否转化为真实预算收益,仍取决于是否做好提示词缓存、上下文压缩、任务路由和失败重试控制。

四、Luna、Terra、Sol 应该怎么选

GPT-5.6 Luna、Terra 与其他模型 API 价格对比
GPT-5.6 Luna、Terra 与其他模型 API 价格对比
  • Luna:适合高频分类、信息抽取、字幕清理、素材标签、镜头日志、常规代码修改与后台智能体。
  • Terra:适合需要更稳定推理的日常专业工作,例如创意规划、自动化脚本、项目分析和多步骤执行。
  • Sol Standard:适合复杂研究、棘手的管线调试、跨项目推理和高价值专业任务。
  • Sol Fast:适合交付窗口紧、等待时间价值高的任务;速度优先的代价是 2 倍价格,建议先做小规模压测。
选择原则:不要只看单 Token 价格。低价模型如果需要更多重试、人工复核或工具轮次,总成本未必更低。先用真实任务统计成功率、平均 Token、耗时和返工率,再决定路由。

五、开发者社区为什么反应强烈

开发者对 GPT-5.6 Luna 降价的社区反馈
开发者对 GPT-5.6 Luna 降价的社区反馈
API 用户对本轮 GPT-5.6 降价的反馈
API 用户对本轮 GPT-5.6 降价的反馈

最直接的反应来自 API 用户:相同预算可以运行更多请求。也有开发者指出,Luna 在 Codex 与计算机操作任务中的实际体验比市场关注度更好;另一部分用户则坦言此前几乎没有使用 Luna,说明降价也是一次重新争取模型调用量的动作。

开发者分享 Luna 在 Codex 和计算机操作任务中的体验
开发者分享 Luna 在 Codex 和计算机操作任务中的体验
部分用户此前较少使用 GPT-5.6 Luna
部分用户此前较少使用 GPT-5.6 Luna

这些评价属于个人使用反馈,不能替代统一基准。Luna 是否适合某条生产管线,仍应在自己的素材类型、工具链和质量标准下测试。不过 80% 的价格下降确实降低了试用门槛,也会迫使同档模型重新证明自己的单位任务价值。

价格竞争正在向整个市场传导

社区将 GPT-5.6 Luna 新价格与 Kimi K3 进行比较
社区将 GPT-5.6 Luna 新价格与 Kimi K3 进行比较
GPT-5.6 降价带来的竞品价格压力讨论
GPT-5.6 降价带来的竞品价格压力讨论
GPT-5.6 降价引发的模型价格竞争讨论
GPT-5.6 降价引发的模型价格竞争讨论

社区很快把 Luna 与 Kimi K3、Anthropic 等产品放在一起比较。此类图片更多表达市场情绪,不能单凭定价判断模型能力高低,但它揭示了一个清晰趋势:模型竞争正在从“谁更聪明”转向“谁能以更低的完成任务成本稳定交付”。

社区对下一代 Luna 智能与成本表现的期待
社区对下一代 Luna 智能与成本表现的期待

六、对视频、CG 与后期从业者意味着什么

对后期团队而言,Luna 的降价最适合释放那些数量大、单次价值不高、但长期占用人力的环节:批量补全素材元数据、清洗字幕、生成镜头描述、整理客户反馈、核查文件命名、编写转码命令,以及为代理文件和归档流程生成结构化记录。

Terra 更适合需要理解项目上下文的工作,例如根据脚本规划剪辑结构、为 Nuke 或 Blender 管线编写工具、分析多轮审片意见。Sol 则应留给复杂故障定位、跨软件自动化和高风险交付;只有等待时间已经影响制作节奏时,Sol Fast 的 2 倍价格才更容易成立。

做视频网观点:真正值得关注的不是“最便宜模型”本身,而是分层路由。把大量机械任务交给 Luna,把需要判断的工作交给 Terra,把最复杂和最紧急的任务分别交给 Sol Standard 与 Fast,再用抽检和回退机制控制质量,才可能把 API 降价转化为项目利润。

七、落地前建议做三项测试

  1. 建立真实任务集:从字幕、素材管理、脚本和管线调试中各选一批代表性任务。
  2. 记录完成任务成本:同时统计 Token、耗时、成功率、重试次数和人工修订时间。
  3. 设置自动回退:Luna 或 Terra 低置信度、工具失败或超出轮次时,自动升级到更强模型。

结语

GPT-5.6 这轮调价最显眼的是 Luna 下降 80%,但更重要的信号是 OpenAI 正在把模型能力、推理效率、智能体编排和产品价格放在同一条优化链上。Luna 负责扩大高频任务的调用规模,Terra 争取日常专业工作,Sol Fast 则用更高价格换取更短等待。

对内容生产团队来说,降价值得欢迎,但不要被“每项任务几美分”代替实际核算。只有基于真实工作流测出完成任务成本,并为不同难度建立模型路由,新的价格优势才会稳定落到制作效率与预算上。

常见问题(FAQ)

GPT-5.6 Luna 降价后的 API 价格是多少?
每100万Token的输入价格为0.20美元,输出价格为1.20美元,相比此前的1美元和6美元均下降80%。
GPT-5.6 Terra 的新价格是多少?
每100万Token的输入价格为2美元,输出价格为12美元,相比此前的2.50美元和15美元下降20%。
标题中的“2折起售”是什么意思?
它指GPT-5.6 Luna的新价格降到原价的20%,也就是下降80%;并不表示Terra、Sol或全部GPT-5.6模型都打2折。
GPT-5.6 Sol Fast 模式有多快、多少钱?
官方称其最高可达到Standard模式的2.5倍速度,价格是Standard的2倍,模型智能水平不变,实际速度会随任务和负载变化。
ChatGPT Work 和 Codex 的订阅或额度变了吗?
订阅价格和额度预算保持不变,但Terra与Luna会消耗更少Credits,因此同等额度可能完成更多任务。
0 点赞
0 收藏
分享
0 讨论
反馈
0 讨论
热门最新
总结
暂无总结
0 / 600
嗨,下午好!
所有的成功,都源自一个勇敢的开始
近期热门