GPT-6 Sol、Luna上线:Astra能力下放,API价格直降50%解析
发布日期:2026-09-23
OpenAI于2026年9月23日正式发布GPT-6系列新成员GPT-6 Sol和GPT-6 Luna,官方定位为把GPT-6 Astra在专业工作、事实性、编码、计算机使用和对齐上的领先能力,带入更快更经济的模型。两者API价格较GPT-5.6促销价直降50%:Sol为输入2美元/百万Token、输出10美元,Luna为输入0.10美元、输出0.50美元。本文解析其定位分工、基准成绩、缓存优化与选型建议。

GPT-6 Sol和Luna是什么?
GPT-6 Sol和Luna是OpenAI GPT-6家族在Astra旗舰之后的规模化成员,采用与Astra类似的方法训练。如果说Astra体现AI智力巅峰,Sol和Luna就是面向千行百业的工业级放大器。
分工明确:Astra要最好效果,Sol要高性价比主力,Luna要极致走量。根据OpenAI官方博客2026年9月23日说明,两款模型均已上线OpenRouter,API型号为gpt-6-sol与gpt-6-luna。
相关实体包括OpenAI、ChatGPT Work、Codex、OpenRouter、Anthropic Claude,以及评测AutomationBench、FrontierCode、DeepSWE。
价格:腰斩背后的双轨策略
本次最直接的变化是价格,只有上一代GPT-5.6的一半。
数据来源:OpenAI官方博客,2026年9月。
Sol与Luna差出一个量级:Sol负责难任务迭代,Luna负责海量轻任务。同期OpenRouter数据显示,OpenAI周消费金额在30个月后首超Anthropic,低价走量是关键推手。
叠加缓存优化,Agent复用上下文可享90%的缓存读取折扣。GitHub报告称,数月内需新鲜处理的提示词占比下降超50%,Copilot响应更快。
专业工作:Sol以9%成本超Opus 5

在AutomationBench业务流测试中,GPT-6 Sol xhigh达33.2%,成本仅0.27美元/任务。
超Claude Opus 5 max的26.9%,成本仅为其9%。
超Claude Fable 5.1的31.4%,成本不到1/9。
甚至超过低档Astra的30.3%,成本仅1/3.9。
Agents Last Exam达56.4%,接近Opus 5最高分但成本低60%。
Luna同样涨点:高档较前代提升5.4个百分点,单任务成本低58%。事实性上,Sol犯错数约为前代一半,接近Astra水平;Luna高档可 matching GPT-5.6 Sol,成本仅约1/100。
编码:DeepSWE逼近Fable,成本低80%
编码是Sol和Luna的主战场,OpenAI内部日Token消费中位数已超600美元,90分位超7000美元,低成本迭代至关重要。
FrontierCode:Sol大幅超5.6 Sol,可 matching Fable 5.1 xhigh,成本远低。
DeepSWE v1.1:Sol max达68.8%,距Fable最高的69.9%仅1.1分,成本低约80%。
DeepSWE:Luna max达66.6%,相当Opus 5与Fable中档,成本低93%-96%。
OSWorld 2.0:Sol xhigh达60.5%,持平Opus 5中档的60.3%,成本低80%;Luna超5.6 Sol中档,成本仅1/10。
开发者可通过标准接口直接调用,例如七牛云推理服务兼容主流调用格式,国内可直接访问,适合把Sol做主力、Luna做批量任务的组合测试。
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="gpt-6-sol",
messages=[{"role": "user", "content": "用React实现Bento网格+右上滑动切换,检查是否真需引入React"}]
)
print(resp.choices[0].message.content)模型名与Key为占位符,以OpenAI官方文档为准。

协作风格与对齐:更像人,更少忽悠
Sol和Luna继承了Astra的沟通风格:更清晰、更少行话、更少怪异转折、细节更精练。在Bento官网改版对比中,6代会先确认是否真需React并说明测了什么,5.6代则直接开干。
对齐上,两者在编码欺瞒、破坏搜索、绕过评审等项均优于5.6 counterpart。OpenAI提醒,这些是刻意找茬的压力测试,日常失效率远低,详见系统卡。
适合什么场景?
Sol主力编码:FrontierCode与DeepSWE逼近旗舰,适合Codex长任务迭代。
Luna批量任务:0.1美元输入价,适合分类、抽取、大规模数据收集。
业务流Agent:AutomationBench性价比断层,适合销售、财务、HR跨应用编排。
不适合:极限旗舰任务仍选Astra;Chat免费版暂仅有Luna桌面端,Sol需Plus以上。
已上线ChatGPT Work与Codex的Plus、Pro、Business、Enterprise、Edu,Free与Go可在桌面用Luna,Chat暂未上,全天灰度中。
常见问题
Q:GPT-6 Sol和Luna最大区别是什么? Sol是主力性价比,输入2美元输出10美元;Luna是极致走量,输入0.10美元输出0.50美元,两者均比5.6便宜50%,能力分别对标中高档与轻量任务。
Q:Sol真能替代Astra或Opus 5吗? AutomationBench上Sol以9%成本超Opus 5,DeepSWE距Fable仅1.1分,适合多数任务;极限深度仍需Astra,建议以自身任务实测为准。
Q:怎么接入?型号名是什么? API型号为gpt-6-sol与gpt-6-luna,已上OpenRouter,ChatGPT Work与Codex今日灰度,需Plus以上,Luna另有免费桌面入口。
Q:缓存90%折扣怎么用? 开启提示缓存仪表盘与诊断工具,调推理力度与工具开关不再破坏缓存,用显式断点控制前缀,Agent长对话复用率最高。
Q:国内如何低成本对比? 可用国内可直接访问的多模型平台同题跑Sol、Luna与竞品,记录质量与单任务成本后再定主力。
总结
GPT-6 Sol和Luna是一次 industrial级放大:Astra的方法论,Sol的价格,Luna的量。据OpenAI官方博客2026年9月数据,其成本智能曲线已全面领先,OpenRouter消费反超即是注脚。本文基于2026年9月数据,价格与灰度状态可能调整,以官方定价页为准。
参考资料:
OpenAI官方博客 Introducing GPT-6 Sol and Luna:https://openai.com/index/introducing-gpt-6-sol-and-luna/
IT之家 OpenAI发布GPT-6 Sol和Luna:https://baijiahao.baidu.com/s?id=1877062820748784460&wfr=spider&for=pc
多模型API对比测试:https://www.qiniu.com/ai/models