GPT-6 Sol与Luna震撼发布!价格大幅下调,引领AI新潮流

2026-09-29 06:25:14未知 作者:徽声在线


徽声在线最新报道


AI领域迎来了一场震撼的发布盛宴!

就在不久前,GPT-6 Sol与Luna两款重量级模型惊艳亮相!

而在此之前数小时,Opus 5.5才刚刚揭开神秘面纱。


此次,GPT-6系列全家桶一次性推出GPT-6 Sol与GPT-6 Luna两大模型。


如果说Astra代表了AI智力领域的巅峰之作,那么Sol与Luna则是OpenAI精心打造的、能够广泛应用于各行各业的工业级AI利器。

它们完美继承了Astra在专业推理、代码编写以及与人类交互方面的卓越性能,分别代表了两个不同方向的实用场景。

Sol被誉为「超级大脑」,擅长破解极其复杂的代码逻辑以及处理超长线的智能体工作流;

而Luna则是「效率狂魔」,以其极快的速度和极低的资源占用,专为一切专注型、高频吞吐的日常任务而生。

更令人惊喜的是,这两款模型在API定价上相较于上一代直接砍半,高达50%的降幅!从此,百万级Token的消耗将不再让人望而却步。



OpenAI首席执行官奥特曼表示,GPT-6 Sol与Luna两款模型在按任务定价的市场上,几乎找不到竞争对手。

正如OpenAI所言:「借助Sol进行构建,利用Luna进行扩展,共同迈向生产环境与更加广阔的未来。」


站在巨人Astra的坚实肩膀上

此次发布的Sol与Luna,采用了与GPT-6 Astra相似的训练方法,汲取了Astra在专业工作、事实准确性、代码编写、计算机视觉操作以及与人类交互方面的最先进成果。

GPT-6 Sol:复杂工作流的「超级大脑」

Sol的定位是处理那些极其困难、需要深度思考和逻辑推理的任务。

它专为复杂的代码重构、长逻辑链的商业决策以及需要多步规划的Agent工作流而设计。

简而言之,它适用于那些「难啃的硬骨头」任务。

GPT-6 Luna:专注、神速的「效率狂魔」

Luna则是为了应对高吞吐量、极其专注的任务而生的。

比如,它能够瞬间从几百页的PDF中提取出特定的发票数据,或者实时翻译海量的用户聊天记录。

Luna以其极快的速度和几乎可以忽略不计的成本,专为企业级批量处理任务量身打造。

API价格迎来「腰斩」时代

尽管此前的GPT-6 Astra功能强大,但我们日常的大部分工作并不需要如此昂贵的模型。

GPT-6 Sol与Luna的诞生,正是为了让Astra的前沿智能通过极致的成本控制,让普通人也能在日常工作中轻松使用。

得益于在缓存和推理底座架构上的巨大改进,OpenAI成功地将成本大幅降低!而且,没有中间商赚取差价。

与GPT-5.6的促销价相比,GPT-6 Sol与Luna的API价格整整降低了50%!


对于每100万Token,具体价格如下。

GPT-6 Sol(适用于复杂推理)

输入价格:从4美元降至2美元!

输出价格:从20美元降至10美元!

GPT-6 Luna(适用于高频吞吐)

输入价格:从0.20美元降至0.10美元!

输出价格:从1.20美元降至0.50美元!

现在,只需白菜价,就能拥有顶级「赛博打工人」,额度更高,成本更低!


OpenAI特别强调,此次降价是永久性的,原来的限时价再打对折。

跑分成绩将Claude远远甩在身后

在官方博客公布的跑分成绩中,几乎每一项都以Claude为对照,而且每张图的横轴都是每任务成本。

OpenAI强调的是「同样的分数,花费更少的钱」。


Artificial Analysis评价道:GPT-6 Sol与Luna将成本效率的前沿推向了新的高度。

首先,是在真实工作环境中的表现。

在AutomationBench(商业工作流跨应用测试)中,GPT-6 Sol(xhigh级别)取得了33.2%的成绩,每任务成本仅为0.27美元,直接超越了Fable 5.1(max级别),每项任务的报告成本降低了惊人的88%!

而Claude Opus 5的最高分仅为26.9%,成本却是Sol的11.1倍。


OpenAI特别指出,Fable 5.1虽然取得了31.4%的成绩,但有约40%的任务转给了Opus 5进行兜底,这部分成本并未计算在内,因此其实际成绩被低估了。


在Agents' Last Exam(智能体终极考试)中,测试的是55个细分行业里的长链条专业任务。

Sol在最高强度下取得了56.4%的成绩,高于Opus 5的最好成绩,且每任务成本低60%。


在事实准确性方面,Sol犯的事实错误比上一代减少了一半左右,接近Astra的水平。

Luna在高强度档的表现追平了GPT-5.6 Sol,但成本大约是后者的百分之一。


接下来,重点来看看编程场景的表现。

在FrontierCode测试中,GPT-6 Sol相比前代实现了巨大的飞跃。它追平了Fable 5.1的最高档成绩,但成本却低得多。

它不仅能够写出正确的代码,还包括了代码风格、测试质量以及对现有代码库的遵循度等方面的考量。


在DeepSWE测试中,考察的是真实代码库里的复杂软件工程任务。

Sol的max级别得分高达68.8%!Fable 5在这项上的最高分是69.9%,虽然两者相差1.1个百分点,但Sol完成每项任务的成本比Claude足足低了80%!

Luna在max级别下得分66.6%,直接与Opus 5和Fable 5(中等强度)打平,但成本却狂降93%和96%。


接下来,是电脑操作方面的表现。

在OSWorld 2.0离线测试中,GPT-6 Sol仅用20%的成本就打平了Claude Opus 5的成绩。

而Luna更是用十分之一的成本直接超越了前代的GPT-5.6 Sol!


在人类对齐方面,OpenAI专门测试了模型在编程时是否会撒谎。

在「欺骗性代码测试」(故意引诱AI说谎的测试)中,GPT-5.6 Sol的欺骗率为10.4%,而GPT-6 Sol降至1.3%。


另外,他们还测试了当搜索工具出现故障时,模型是否会瞒着用户硬编答案。

GPT-5.6 Sol有77.5%的情况选择不说,而GPT-6 Sol降至4.9%,Luna从78.3%降到28.7%。


底层细节大优化:告别AI味,缓存输入Token费用大降

OpenAI特意透露,此次他们在底层细节上进行了不少优化。

首先,是两个模型告别了AI味和说教式的回答。

GPT-6 Sol与Luna的回答极其清晰,没有废话;拒绝使用生僻专业术语和奇怪的句式;回答更短,但干货满满。

比如,当被问及网站结构时,GPT-6 Sol不会啰嗦,而是直奔主题,用词精准,不含糊其辞。


生成速度更快、Token使用更少的原因,在于GPT-6这次史诗级强化的Prompt缓存技术。

在过去,AI每次都会把所有前置上下文重新阅读一遍,而在GPT-6中,缓存命中率大幅提高。

更令人惊叹的是:命中的缓存输入Token,费用直接打一折!

现在,开发者拥有超高的控制权。

可以随时调整模型的「推理力度」,遇到难题调高,遇到简单问题调低,这个过程不会打断缓存!

可以随时开启或关闭工具,依然不会打断缓存!

甚至可以手动设置「断点」,精确控制缓存的位置。

GitHub报告称:在对数十亿次API请求的监控中,需要重新处理的提示词token占比暴降50%以上。

首轮实测结果出炉

GPT-6硬刚Opus 5.5

既然同一天撞上了Opus 5.5,这届看热闹不嫌事大的网友怎么可能放过这场「世纪神仙打架」。

第一波实测结果已经新鲜出炉!

Bridgebench平台邀请四大新模型一同生成一个火箭发射台。

GPT 6 Luna仅在65秒内就搭建完毕,成本仅0.01美金。其余三个模型的成本和时间如下:

GPT 6 Sol:0.11美金,1分钟;

Grok 4.7:0.29美金,11分钟

Claude Opus 5.5:1.52美金,12分钟


GPT 6 Sol与Opus 5.5的另一轮对决选在了SVG的战场上。

开发者Angel一句话直戳痛点:「常言道,一图胜千言」。


在这个测试中,明显可以看出两款模型在场景理解和细节处理上的差异。


还有位开发者Azazide整了一个更硬的绝活,把Opus 5.5和GPT-6 Sol扔去管理火星基地。

规则极其残酷:100名殖民者,生死倒计时90秒,全程0人类介入。

它们接手的是一个濒临崩溃的火星殖民地——氧气管路泄漏、蓄电池起火、超强沙尘暴压境、电力全面瘫痪,而手里能调动的只有区区3台维修漫游车。

两边AI都得在毫秒间做出「电车难题」般的抉择。

令人意外的是,它们通过各自的策略,稳稳保住了100名殖民者的生命。


一段预告片,做出能玩的「塞尔达」

开发者Flavio Adamo提前上手了Sol,测完后的第一感受是:「模型效率极高,速度和token用量都很惊人」。

在输入《塞尔达传说:时之笛》的一段预告片后,Sol直接手搓出一个可玩版游戏。


网友Chetan Ankola则用GPT-6解锁了动漫风格的网页生成。


马上体验!GPT-6全平台解锁

好消息是,这两大模型今天就可以使用了!

ChatGPT平台:GPT-6 Sol与Luna将在ChatGPT Work中向Plus、Pro、Business、Enterprise和Edu(教育版)用户全量推送!

Codex平台:两大模型同步上线。免费体验通道:广大的Free和Go用户也可以在桌面端App中抢先体验GPT-6 Luna。

开发者API:模型已在API后台开放,名称分别为gpt-6-sol和gpt-6-luna。

这一晚,ASI双雄的对决太过激烈。

开发者们都别睡了,赶快行动起来吧!

参考资料:

http://xn--https-uf5io91m//x.com/OpenAI/status/2102460975790137662?s=20

https://x.com/ChatGPT/status/2102462020339613966?s=20

https://openai.com/index/introducing-gpt-6-sol-and-luna/

编辑:Aeneas 摩西 桃子

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚 地平线押注车企中“沉默的大多数”地平线押注车企中“沉默的大多数”
相关文章
GPT-6 Sol与Luna震撼发布!价格大幅下调,引领AI新潮流GPT-6 Sol与Luna震撼发布!价格大幅下调,引领AI新潮流 启境GX7上市:搭载L3级架构、标配宁德电池,瞄准主流家庭SUV市场启境GX7上市:搭载L3级架构、标配宁德电池,瞄准主流家庭SUV市场 以“中国专属”策略回应市场期待,全新奔驰长轴距GLE SUV闪耀登场 李德思:在变革中坚守“奔驰标准”以“中国专属”策略回应市场期待,全新奔驰长轴距GLE SUV闪耀登场 李德思:在变革中坚守“奔驰标准” 小米18Pro系列震撼发布,起售价5999元起,透明特别版惊艳亮相小米18Pro系列震撼发布,起售价5999元起,透明特别版惊艳亮相 深入探访安世中国研发中心:晶圆断供后本土供应链方案启动 迈向12英寸新时代深入探访安世中国研发中心:晶圆断供后本土供应链方案启动 迈向12英寸新时代 小米18 Pro透明特别版震撼发布,9999元起售引热议小米18 Pro透明特别版震撼发布,9999元起售引热议