
大模型价格战,这次打到了 "永久"两个字上。
昨天,OpenAI发布GPT-6 Sol与GPT-6 Luna,官方口径:相比GPT-5.6的促销价,API再降50%——而且是永久定价,不玩限时。Sol每百万token输入2美元、输出10美元,Luna直接打到0.1美元和0.5美元。

同一天上午,Anthropic刚发了Opus 5.5。90分钟后,OpenAI掀了桌子。
OpenAI发布GPT-6 Sol/Luna,API永久降价50%,Luna输入价0.1美元创前沿模型地板价。峰值分数小幅回退、对比对象避开同日发布的Opus 5.5——降价是真的,口径上的花招也得摊开看。
公开资料能确认的是,这次发布把GPT-6 Astra在编程、专业工作、事实准确性和电脑操作上的部分进展,下放到了更快、更便宜的两款模型上。
规格如下:Sol面向复杂编程和Agent工作流,Luna主打高频低成本任务。两者均支持105万token上下文、12.8万最大输出,推理强度六档可调。API模型名分别为gpt-6-sol和gpt-6-luna。

内部测试口径:Sol的事实性错误约为前代一半;DeepSWE 1.1中Sol最高68.8%,Luna 66.6%。官方给出的成本对比里,Sol在AutomationBench单任务成本0.27美元,得分高于Opus 5、成本仅为其9%;Luna的DeepSWE成绩接近Opus 5和Fable 5的中档水平,单任务成本分别低93%和96%。
开放范围:Plus、Pro、Business、Enterprise、Edu用户在ChatGPT Work和Codex可用,API同步开放;Free和Go用户可在桌面应用使用Luna。普通聊天界面暂未接入。
这次升级的核心变化,可以用一张图说清。

数据拆开看:DeepSWE v1.1上,Sol最高分68.8%,低于上代Sol的72.7%,也低于Opus 5的73.7%;OSWorld 2.0电脑操作同样回退,60.5%对上代的65.7%。峰值分数降了,整条成本曲线却左移了——同样的预算能跑的任务量翻了两三倍,同样的分数档价格便宜一大截。
这个取舍指向一个明确的判断:对每天跑几千次Agent调用的团队,单任务成本比峰值分数重要。OpenAI把性价比整体往左挪,峰值让出来,走量吃下来。
Luna是这套打法里最锋利的一档:0.1美元的输入价是所有前沿级模型的地板价,且免费用户在桌面端即可使用。
发布密度本身就说明问题。9月21日xAI发布Grok 4.7,输入价定在2美元;9月22日Anthropic发布Opus 5.5;90分钟后OpenAI的Sol输入价也定在2美元。

合理推演是,价格战已从"成本下降让利"进入"卡位定价"阶段:谁在开发者心智里占住默认选项,谁就拿下半场。官方对媒体明确"永久定价",等于堵死促销退路——这是长期卡位动作。
另一个观察点:GPT-6系列目前没有Terra中端档。要么留着后发,要么OpenAI判断"旗舰Astra+走量Sol/Luna"的两极结构已经够用。
几个口径问题需要摊开。
关于对比对象:同日发布的Opus 5.5在两家同口径报告的两个基准上均压过Sol——AutomationBench 40.0%对33.2%,FrontierCode 1.1为54.4%对49.3%——但OpenAI官方对比图里只出现了Opus 5和Fable 5,官方解释为"无分项数据时以Fable 5顶替"。
关于降幅基准:"降价50%"的锚是GPT-5.6的促销价,该促销价11月21日到期、届时将涨回原价;若对比原价,降幅实为60%。另有一条隐藏条款:单次请求超27.2万token,输入价翻倍、输出价乘1.5。
关于实测:第三方测试让三款GPT-6模型跑同一组构建任务,Astra全胜,Sol次之,Luna再次,排序与价格一致;便宜档速度快两到六倍,但成品均有可见瑕疵。所有榜单数字均为厂商自测口径,跨厂商横评尚未有同口径第三方结果。
可信度层面,落地事实是清楚的:API已开放、价格为永久定价、免费桌面端已可用。存疑的是能力叙事——峰值分数回退、对比对象选择性选取,"升级"二字在峰值维度并不成立。
这次发布的行业信号在定价结构:三周前Astra捅天花板,现在Sol和Luna砸地板,一个家族覆盖企业级推理到高频文书的全预算层级。对开发者的实际影响很直接:选型标准从每token单价切换到单任务成本。
下一轮的观察点有两个:Opus 5.5与GPT-6 Sol的同口径第三方横评结果,以及中端档Terra是否补位。价格战的下半场,刚落下第一颗子。
