GPT-5.6降价:Luna直降80%,Terra降20%,额度多撑几轮

今天凌晨,海外AI厂商OpenAI正式宣布下调GPT-5.6系列中Luna和Terra两款模型的调用价格,调整于公告当日即刻生效。此前有行业观察者提到本周的行业主题将围绕“高性价比智能模型”展开,原本不少用户猜测平台的周额度会迎来重置,计划趁着额度更新加大使用力度,但最终并未迎来额度调整,反而是模型调用成本率先迎来了下调。
本次调价中,Luna模型的价格直接下调了80%,Terra模型则下调了20%。针对使用Codex和ChatGPT Work的用户来说,调用Luna和Terra时扣减的credits额度也会相应减少,但平台的订阅套餐价格以及固定的quota预算并未发生变化。
周额度是否会迎来重置?
周额度的调整仍需以相关平台公告为准,但好消息是,用户当前剩余的少量额度确实可以支持多进行几轮调用。
API单价与订阅credits计费互不干扰
以标准调用模式为例,Luna模型每百万token的输入、缓存输入以及输出的单价分别为0.2美元、0.02美元和1.2美元;Terra模型对应三项的单价则为2美元、0.2美元和12美元。Sol模型的标准调用价格并未调整,三项单价依旧保持为5美元、0.5美元和30美元。
本次调价中Luna的降价幅度最为显著,每百万输入token仅需0.2美元,此前不少用户认为批量运行任务成本偏高,现在可以重新核算相关使用成本了。对于直接调用API的用户来说,最直观的感受就是月度账单金额明显降低;而使用Codex的用户则会发现,相同额度的credits可以支撑更多的调用次数,两类用户都能享受到成本优化带来的好处,只是计费的方式有所区别。
Sol Fast模式:加急调用的付费选项
Sol Fast模式是另一套独立的计费规则:该模式的调用速度最高可达标准模式的2.5倍,但收费为标准模式的两倍。对应到每百万token的单价,输入、缓存输入以及输出分别为10美元、1美元和60美元。
这套模式的逻辑非常清晰:如果需要尽快拿到调用结果,可以选择该模式支付双倍费用;如果对响应速度没有极高要求,则可以使用标准模式等待调用完成。需要注意的是,2.5倍只是速度上限,并非每次调用都能达到满速,无需为所有任务都选择该模式。
整体来看,本次调价并不会让用户的周额度一夜之间恢复满额,但剩余的少量额度确实可以支撑多轮调用。对于API用户来说,最直接的利好是此前因成本偏高而搁置的批量Luna、Terra调用任务,现在可以重新尝试运行了。

