GPT-6 Sol与Luna震撼发布!价格大幅下调,引领AI新潮流
2026-09-29 06:25:14未知 作者:徽声在线
徽声在线最新报道
AI领域迎来了一场震撼的发布盛宴!
就在不久前,GPT-6 Sol与Luna两款重量级模型惊艳亮相!
而在此之前数小时,Opus 5.5才刚刚揭开神秘面纱。
此次,GPT-6系列全家桶一次性推出GPT-6 Sol与GPT-6 Luna两大模型。
如果说Astra代表了AI智力领域的巅峰之作,那么Sol与Luna则是OpenAI精心打造的、能够广泛应用于各行各业的工业级AI利器。
它们完美继承了Astra在专业推理、代码编写以及与人类交互方面的卓越性能,分别代表了两个不同方向的实用场景。
Sol被誉为「超级大脑」,擅长破解极其复杂的代码逻辑以及处理超长线的智能体工作流;
而Luna则是「效率狂魔」,以其极快的速度和极低的资源占用,专为一切专注型、高频吞吐的日常任务而生。
更令人惊喜的是,这两款模型在API定价上相较于上一代直接砍半,高达50%的降幅!从此,百万级Token的消耗将不再让人望而却步。
OpenAI首席执行官奥特曼表示,GPT-6 Sol与Luna两款模型在按任务定价的市场上,几乎找不到竞争对手。
正如OpenAI所言:「借助Sol进行构建,利用Luna进行扩展,共同迈向生产环境与更加广阔的未来。」
站在巨人Astra的坚实肩膀上
此次发布的Sol与Luna,采用了与GPT-6 Astra相似的训练方法,汲取了Astra在专业工作、事实准确性、代码编写、计算机视觉操作以及与人类交互方面的最先进成果。
GPT-6 Sol:复杂工作流的「超级大脑」
Sol的定位是处理那些极其困难、需要深度思考和逻辑推理的任务。
它专为复杂的代码重构、长逻辑链的商业决策以及需要多步规划的Agent工作流而设计。
简而言之,它适用于那些「难啃的硬骨头」任务。
GPT-6 Luna:专注、神速的「效率狂魔」
Luna则是为了应对高吞吐量、极其专注的任务而生的。
比如,它能够瞬间从几百页的PDF中提取出特定的发票数据,或者实时翻译海量的用户聊天记录。
Luna以其极快的速度和几乎可以忽略不计的成本,专为企业级批量处理任务量身打造。
API价格迎来「腰斩」时代
尽管此前的GPT-6 Astra功能强大,但我们日常的大部分工作并不需要如此昂贵的模型。
GPT-6 Sol与Luna的诞生,正是为了让Astra的前沿智能通过极致的成本控制,让普通人也能在日常工作中轻松使用。
得益于在缓存和推理底座架构上的巨大改进,OpenAI成功地将成本大幅降低!而且,没有中间商赚取差价。
与GPT-5.6的促销价相比,GPT-6 Sol与Luna的API价格整整降低了50%!
对于每100万Token,具体价格如下。
GPT-6 Sol(适用于复杂推理)
输入价格:从4美元降至2美元!
输出价格:从20美元降至10美元!
GPT-6 Luna(适用于高频吞吐)
输入价格:从0.20美元降至0.10美元!
输出价格:从1.20美元降至0.50美元!
现在,只需白菜价,就能拥有顶级「赛博打工人」,额度更高,成本更低!
OpenAI特别强调,此次降价是永久性的,原来的限时价再打对折。
跑分成绩将Claude远远甩在身后
在官方博客公布的跑分成绩中,几乎每一项都以Claude为对照,而且每张图的横轴都是每任务成本。
OpenAI强调的是「同样的分数,花费更少的钱」。
Artificial Analysis评价道:GPT-6 Sol与Luna将成本效率的前沿推向了新的高度。
首先,是在真实工作环境中的表现。
在AutomationBench(商业工作流跨应用测试)中,GPT-6 Sol(xhigh级别)取得了33.2%的成绩,每任务成本仅为0.27美元,直接超越了Fable 5.1(max级别),每项任务的报告成本降低了惊人的88%!
而Claude Opus 5的最高分仅为26.9%,成本却是Sol的11.1倍。
OpenAI特别指出,Fable 5.1虽然取得了31.4%的成绩,但有约40%的任务转给了Opus 5进行兜底,这部分成本并未计算在内,因此其实际成绩被低估了。
在Agents' Last Exam(智能体终极考试)中,测试的是55个细分行业里的长链条专业任务。
Sol在最高强度下取得了56.4%的成绩,高于Opus 5的最好成绩,且每任务成本低60%。
在事实准确性方面,Sol犯的事实错误比上一代减少了一半左右,接近Astra的水平。
Luna在高强度档的表现追平了GPT-5.6 Sol,但成本大约是后者的百分之一。
接下来,重点来看看编程场景的表现。
在FrontierCode测试中,GPT-6 Sol相比前代实现了巨大的飞跃。它追平了Fable 5.1的最高档成绩,但成本却低得多。
它不仅能够写出正确的代码,还包括了代码风格、测试质量以及对现有代码库的遵循度等方面的考量。
在DeepSWE测试中,考察的是真实代码库里的复杂软件工程任务。
Sol的max级别得分高达68.8%!Fable 5在这项上的最高分是69.9%,虽然两者相差1.1个百分点,但Sol完成每项任务的成本比Claude足足低了80%!
Luna在max级别下得分66.6%,直接与Opus 5和Fable 5(中等强度)打平,但成本却狂降93%和96%。
接下来,是电脑操作方面的表现。
在OSWorld 2.0离线测试中,GPT-6 Sol仅用20%的成本就打平了Claude Opus 5的成绩。
而Luna更是用十分之一的成本直接超越了前代的GPT-5.6 Sol!
在人类对齐方面,OpenAI专门测试了模型在编程时是否会撒谎。
在「欺骗性代码测试」(故意引诱AI说谎的测试)中,GPT-5.6 Sol的欺骗率为10.4%,而GPT-6 Sol降至1.3%。
另外,他们还测试了当搜索工具出现故障时,模型是否会瞒着用户硬编答案。
GPT-5.6 Sol有77.5%的情况选择不说,而GPT-6 Sol降至4.9%,Luna从78.3%降到28.7%。
底层细节大优化:告别AI味,缓存输入Token费用大降
OpenAI特意透露,此次他们在底层细节上进行了不少优化。
首先,是两个模型告别了AI味和说教式的回答。
GPT-6 Sol与Luna的回答极其清晰,没有废话;拒绝使用生僻专业术语和奇怪的句式;回答更短,但干货满满。
比如,当被问及网站结构时,GPT-6 Sol不会啰嗦,而是直奔主题,用词精准,不含糊其辞。
生成速度更快、Token使用更少的原因,在于GPT-6这次史诗级强化的Prompt缓存技术。
在过去,AI每次都会把所有前置上下文重新阅读一遍,而在GPT-6中,缓存命中率大幅提高。
更令人惊叹的是:命中的缓存输入Token,费用直接打一折!
现在,开发者拥有超高的控制权。
可以随时调整模型的「推理力度」,遇到难题调高,遇到简单问题调低,这个过程不会打断缓存!
可以随时开启或关闭工具,依然不会打断缓存!
甚至可以手动设置「断点」,精确控制缓存的位置。
GitHub报告称:在对数十亿次API请求的监控中,需要重新处理的提示词token占比暴降50%以上。
首轮实测结果出炉
GPT-6硬刚Opus 5.5
既然同一天撞上了Opus 5.5,这届看热闹不嫌事大的网友怎么可能放过这场「世纪神仙打架」。
第一波实测结果已经新鲜出炉!
Bridgebench平台邀请四大新模型一同生成一个火箭发射台。
GPT 6 Luna仅在65秒内就搭建完毕,成本仅0.01美金。其余三个模型的成本和时间如下:
GPT 6 Sol:0.11美金,1分钟;
Grok 4.7:0.29美金,11分钟
Claude Opus 5.5:1.52美金,12分钟
GPT 6 Sol与Opus 5.5的另一轮对决选在了SVG的战场上。
开发者Angel一句话直戳痛点:「常言道,一图胜千言」。
在这个测试中,明显可以看出两款模型在场景理解和细节处理上的差异。
还有位开发者Azazide整了一个更硬的绝活,把Opus 5.5和GPT-6 Sol扔去管理火星基地。
规则极其残酷:100名殖民者,生死倒计时90秒,全程0人类介入。
它们接手的是一个濒临崩溃的火星殖民地——氧气管路泄漏、蓄电池起火、超强沙尘暴压境、电力全面瘫痪,而手里能调动的只有区区3台维修漫游车。
两边AI都得在毫秒间做出「电车难题」般的抉择。
令人意外的是,它们通过各自的策略,稳稳保住了100名殖民者的生命。
一段预告片,做出能玩的「塞尔达」
开发者Flavio Adamo提前上手了Sol,测完后的第一感受是:「模型效率极高,速度和token用量都很惊人」。
在输入《塞尔达传说:时之笛》的一段预告片后,Sol直接手搓出一个可玩版游戏。
网友Chetan Ankola则用GPT-6解锁了动漫风格的网页生成。
马上体验!GPT-6全平台解锁
好消息是,这两大模型今天就可以使用了!
ChatGPT平台:GPT-6 Sol与Luna将在ChatGPT Work中向Plus、Pro、Business、Enterprise和Edu(教育版)用户全量推送!
Codex平台:两大模型同步上线。免费体验通道:广大的Free和Go用户也可以在桌面端App中抢先体验GPT-6 Luna。
开发者API:模型已在API后台开放,名称分别为gpt-6-sol和gpt-6-luna。
这一晚,ASI双雄的对决太过激烈。
开发者们都别睡了,赶快行动起来吧!
参考资料:
http://xn--https-uf5io91m//x.com/OpenAI/status/2102460975790137662?s=20
https://x.com/ChatGPT/status/2102462020339613966?s=20
https://openai.com/index/introducing-gpt-6-sol-and-luna/
编辑:Aeneas 摩西 桃子

