在GPT-5.6系列正式发布仅三周后,OpenAI于7月30日宣布对旗下两款模型实施大幅降价,同时为旗舰模型推出全新的“Fast模式”。此举正值企业对AI成本日益敏感、市场竞争日趋激烈之际。
本次降价主要涉及GPT-5.6系列中的两款模型。GPT-5.6Luna:作为系列中最快、最经济的模型,其价格下调80%。调整后,每百万输入Token价格从1美元降至0.20美元,输出Token从6美元降至1.20美元。GPT-5.6Terra:作为定位“日常干活主力”的均衡型模型,价格下调20%。调整后,每百万输入Token价格降至2美元,输出Token降至12美元。
降价后,Luna的输入价格已与上一代轻量级模型GPT-5.4nano持平,输出价格甚至更低。但Luna的能力更强,支持工具调用、长上下文和多步骤工作流。OpenAI实际上正将以Agent能力为核心的模型,卖到了过去简单小模型的价位。
这些新价格也同步适用于Codex和ChatGPTWork等付费订阅服务中的用量计算。用户的订阅额度总量不变,但调用Terra和Luna时消耗的额度将减少,相当于同等订阅费能让模型“多干几次活”。
旗舰模型GPT-5.6Sol本次价格保持不变。但OpenAI在API中推出了全新的“Fast模式”,取代此前的PriorityProcessing服务。
该模式专为对延迟高度敏感的生产环境设计,可为GPT-5.6Sol提供最高2.5倍的处理速度,价格为标准模式的两倍。两者模型智能水平完全一致。此前使用“priority”标签的API请求将自动切换至Fast模式。