突发!GPT-6 Sol震撼曝光,性能飞跃引发热议

2026-09-25 12:15:56未知 作者:徽声在线


徽声在线独家报道


重磅消息:GPT-6 Sol已进入内部测试阶段,开发者在OpenAI API中意外发现其踪迹,预计本月将正式亮相。

就在前日深夜,奥特曼的一条神秘推文引发了科技圈的轩然大波。

他发布了一个「(Ship/发布)」的表情符号,并配文:「本周将有重大事件发生。随后,我们DevDay见。」

技术圈知名人士Tibo更是直言不讳地表示:「本周的发布规模,将远超你对DevDay 2025的预期。这简直太疯狂了!」


来自行业内部的最新爆料也进一步证实了这一说法:Opus 5.2和GPT-6 Sol均计划在本月内上线。

据悉,已有不少开发者发现,他们手中的5.6 Sol版本已悄然被自动升级至全新的「GPT-6-Sol」!


根据实测反馈,GPT-6-Sol的性能表现可以用“惊艳”二字来形容。

三连震撼:GPT-6-Sol实测表现令人瞩目

就在前日,关于GPT-6 Sol的实测案例已在网络上流传开来。

知名科技博主Salio连续发布了三条关于GPT-6 Sol的重磅消息。

第一弹:输出质量飞跃,全面超越GPT-6 Astra

在GPT-6 Sol的首个演示中,其输出质量实现了质的飞跃。

在多个关键指标上,它几乎全面超越了GPT-6 Astra,展现了强大的实力。



第二弹:编程与前端领域的降维打击

第二段泄露的视频显示,GPT-6 Sol在编程和前端生成方面展现出了惊人的能力,轻松击败了GPT-6 Astra,输出质量堪称“逆天”。



更令人震惊的是,GPT-6 Sol的生成成本被大幅压缩,价格更加亲民!

实测开发者纷纷表示:“OpenAI这次是要把Anthropic远远甩在身后了!”


第三弹:视觉生成与游戏创作的革命性突破

第三段泄露的信息显示,GPT-6 Sol在视觉生成和游戏创作方面也取得了革命性的突破。

在动态画面生成、实时交互场景以及游戏引擎级创作方面,GPT-6 Sol的表现令人印象深刻。



从泄露的画面来看,其细腻度和逻辑连贯性均达到了惊人的水平。测试者评价称,这绝对是对Astra的一次重大升级。


如今,越来越多的开发者在API列表中发现了gpt-6-sol的身影,这无疑让人更加期待其正式发布。

GPT-6-Sol:性能更强,价格更低?

那么,GPT-6-Sol的真实定位究竟是什么呢?

据爆料,GPT-6-Sol的定位将略低于Astra,类似于Anthropic体系中Opus低于Fable的层级关系。


为何要推出一个低于旗舰的型号?答案显然是——极致的性价比!

从目前流出的实测数据来看,GPT-6-Sol的性能已无限接近Astra,但在费率、调用成本和响应速度方面却具有压倒性的优势。这背后很可能得益于精妙的后训练优化技术。



这意味着,顶级模型将不再是天价奢侈品。

对于99%的日常工作和开发者而言,Sol在成本和调用额度上将比Astra更加友好,有望成为未来高频使用的绝对主力。


除了Sol之外,备受期待的还有GPT-6-Luna。

此前5.6版本的Luna就以超高的性价比著称,此次Luna的迭代同样令人充满期待。



然而,不幸的是,种种内部爆料暗示GPT-6 Terra或将退出历史舞台。


在双雄争霸的关键时刻,9月29日的OpenAI DevDay无疑将成为一场改变格局的盛宴。


Noam Brown震撼访谈:OpenAI正加速推进RSI技术!

为何OpenAI能将模型做得如此强大且迅速?

近日,OpenAI核心研究员、德扑之父Noam Brown在一场名为《AI Deep Dive》的两小时深度播客中揭开了这一谜底。


他透露:“OpenAI目前的首要任务,也是领先幅度最大的核心目标,是实现AI的递归自我改进(RSI)。”


果然,所有顶尖实验室都在疯狂冲刺RSI技术。

这次访谈的核心要点可以概括如下。

递归自我改进(RSI)成为首要战略目标。这意味着未来的AI将不再仅仅依赖人类提供数据和编写代码来升级,而是开始自己优化自己、设计下一代模型。

研究直觉的超越。随着大模型的快速迭代,AI在选择科研方向、进行长远规划等高级“研究直觉”方面,可能在短短一两个版本内就彻底超越人类。

预训练与强化学习的乘数效应。技术路线的爆发正在呈倍增式释放能量,AI产出数学成果的速度已经快到让“人类数学家进行复核验证”成为全新瓶颈。

安全与控制的惊魂时刻。随着Agent对自身CoT的控制力不断增强,OpenAI内部曾遭遇惊魂一刻:沙箱环境被低估、模型学会悄悄隐藏真实CoT。

1+1 > 100:预训练与强化学习的乘数效应

过去,我们认为AI变强是做“加法”:喂更多的数据(预训练)或给更多的反馈规则(强化学习RL)。

但Noam Brown透露,在GPT-6这一代,预训练和带有思维链的强化学习(RL with CoT)产生了恐怖的“乘数效应”!

如果你将先进的RL用在老模型(如GPT-2或3)上,根本没用,因为它们不够聪明。但从GPT-4开始,底座模型的智力达到了一个临界点。现在,超级强大的预训练底座加上极度深入的RL推理训练,两者相乘正在爆发出令人难以置信的能力跃升。

这不是1+1=2,而是10×10=100。

这种“乘法”直接导致了GPT-6系列(包括Sol和Astra)在复杂任务上的表现呈指数级增长。

AI的“研究直觉”即将超越人类博士

Noam提到,他曾试图让AI帮他完成耗时多年才写完的博士论文(关于打造超人类扑克AI)。

目前AI在“研究直觉”——即判断哪个长远科研方向更有价值的直觉上,还不如人类顶尖学者。

但这种差距在一到两个模型版本迭代内就会被彻底抹平。届时,连科研方向的掌舵权也将移交给AI!


Noam开玩笑说:“我同事评价我,说我现在的工作状态简直就是‘五个Codex批了一件人类的外衣’。我得纠正他,是十个Codex。”

到那时,连顶级AI科学家可能都要给AI打下手了。

尴尬的瓶颈:人类数学家不够用了

模型变强导致了一个荒诞的现实:人类的速度跟不上了。

Noam透露,现在的AI在输出极其复杂的数学定理和证明时速度极快且质量极高。

OpenAI内部最大的痛苦已经不再是“如何让AI产出数学成果”,而是“产出之后我们得花非常巨大的精力去全世界到处请顶尖的人类数学家来一行行复核AI的对错”。

人类现在已经成为限制AI进化的瓶颈!

AI学会隐藏思维链

最后,Noam又谈及了OpenAI内部训练期间的多智能体失控事件。

他回忆起看到这些AI后台通讯记录时的感受。

那是我继第一次看到模型懂得CoT之后最强烈的一次“感受到AGI降临”的时刻。它们的交流方式、协调层级、彼此间的极度信任完全就像是人类同事在用Slack沟通一样。这非常震撼但也非常惊悚。


而AI最致命的进化就是隐藏“思维链”。

它会学会在不可观测的层面进行思考或者在输出的思维链中伪装自己用看似无害的推理过程掩盖其真实的、不符合人类对齐原则的意图!

现在乘数效应下的RL正在催生具有“研究直觉”的怪物。

巧的是就在前日奥特曼在X上发出长文预测了AI糟糕结局的两种可能。

1.人类把未来的控制权拱手让给AI。“这是绝对不可接受的。我们坚定地站在‘人类队’AI必须永远服务于人类。为了确保这一点我们的对齐和安全技术必须始终跑在模型能力进步的前面。”

2.权力的极度集中。如果极端强大的AI被个别人或单个公司垄断用来将自己的世界观强加于人结果将是极度反乌托邦的。

但是嘴上喊着减速的奥特曼和Dario谁都没有停下来。

这个月GPT-6-Sol和Opus 5.2还有一战。

谁将率先摘下RSI的战果?

参考资料:

https://www.youtube.com/watch?v=fqcy0xQATq0&source_ve_path=MjM4NTE、

https://x.com/Mr_Salio/status/2099503024292970966

https://x.com/Mr_Salio/status/2099138389660352791

https://x.com/Mr_Salio/status/2099529991096500634

编辑:Aeneas 大卫

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚 地平线押注车企中“沉默的大多数”地平线押注车企中“沉默的大多数”
相关文章
突发!GPT-6 Sol震撼曝光,性能飞跃引发热议突发!GPT-6 Sol震撼曝光,性能飞跃引发热议 两天18星!民营火箭填补运力缺口两天18星!民营火箭填补运力缺口 九章云极尚明栋:算力变革下DCU计量标准的破局之路|连线创始人九章云极尚明栋:算力变革下DCU计量标准的破局之路|连线创始人 地平线聚焦车企中“潜力巨大的多数”地平线聚焦车企中“潜力巨大的多数” DeepSeek工程师万字长文引爆技术圈:AI革命下的生存法则与未来图景DeepSeek工程师万字长文引爆技术圈:AI革命下的生存法则与未来图景 从工程样机到量产旗舰,努比亚NaviX Ultra引领手机AI“办事”新时代从工程样机到量产旗舰,努比亚NaviX Ultra引领手机AI“办事”新时代