GPT-6 Sol即将发布?内部「AGI」雏形Bel引关注
2026-09-29 04:55:04未知 作者:徽声在线
徽声在线报道
GPT-6 Sol,即将震撼登场!
英伟达已悄然投入使用。
近日,有敏锐的开发者在英伟达的代码合并记录中,意外发现了「GPT-6 Sol medium」的字样,这一发现迅速在科技圈引发热议。
更令人瞩目的是,行业内已经出现了成熟的「AI协作矩阵」案例——由当前的旗舰模型GPT-6 Astra负责编写代码,随后直接交由GPT-6 Sol进行代码审查,这一流程展现了AI模型间的高效协作。
如今,X平台上关于OpenAI和Anthropic两家的爆料层出不穷。
有消息人士透露,就在本周二(甚至有人精准到周二凌晨3点),OpenAI将正式全面发布GPT-6 Sol,这一消息让众多AI爱好者翘首以盼。
面对OpenAI的这一举动,隔壁的Anthropic显然不愿坐视不理,传闻他们已拉响内部警报,计划将原定计划提前,在同一时间强势推出Claude Opus 5.5,意图截胡。
这一周,AI领域注定不平静。
周二见?GPT-6「全家桶」即将来袭
「别睡了,准时刷新!」这几天,X平台上的AI博主们纷纷奔走相告。
原因是多方信源同时指向了一个关键时间点。
甚至AI领域知名人士Tibo也意味深长地暗示:「周二凌晨3点!」
GPT-6 Sol的发布,似乎已箭在弦上。
根据目前的爆料,Sol并非最高端的大杯型号,而是一个「中间款」,其能力介于GPT-5.6 Sol和最强旗舰GPT-6 Astra之间。
但千万别因为它是个「中间款」就小看它,据内部流出的消息,Sol的性价比极高,令人惊叹。
速度与效率并存:Sol消耗的Token显著更少,运行速度比Astra和5.6快得多,体感上类似谷歌的Gemini 3.8 Flash,但在整体推理能力上却形成了明显优势。
全面适配多平台:除了英伟达,多个平台已在紧锣密鼓地添加对gpt-6-sol的全面支持,包括OpenAI API、Codex OAuth、图像输入功能,以及强大的长上下文处理能力。此外,它还提供了从「低」到「超高」的多挡推理选项,满足不同用户需求。
价格亲民:这是最让开发者兴奋的一点。据泄露的截图显示,GPT-6-Sol的定价可能是$2.50/$15(输入/输出),这个价格仅仅是GPT-5.6-Sol的一半!如果在能力上真如传言般是一次「6.2级别的跃升」,那么这个价格将直接改变行业格局。
更有传闻称,这次发布将是「GPT-6三件套全家桶」。
GPT-6 Sol(旗舰超大杯)
GPT-6 Terra(均衡日常大杯)
GPT-6 Luna(又快又便宜的中杯)
这意味着,在昂贵的Astra之后,真正能让普通用户放心使用的新一代模型矩阵,终于要落地了。
Plus用户有望直接在对话框中体验到6 Sol的强大功能。
内部「AGI」雏形浮现?神秘模型「Bel」实力几何
伴随这次爆料,还流传出一个非常厉害的内部代号。
据知名爆料人透露,GPT-6 Sol之所以能做到「更便宜且更智能」,是因为它背后有一个更为强大的「导师」,这个内部模型的代号叫做「Bel」。
「Bel」在OpenAI内部是什么地位?传言称,它在内部被视为「AGI」的雏形。
它的能力远超目前市面上的GPT-6 Astra,可以说,正是有了Bel的协助和蒸馏,才诞生了这次的GPT-6 Sol。
OpenAI的内部员工对Bel的评价极高,甚至有员工在X上感慨:「智能已经便宜到无法计量」。
这种技术上的突破,给OpenAI带来了极大的自信。
据说,OpenAI内部现在越来越确信,他们的领先优势已经大到其他任何实验室(包括Anthropic和谷歌)都无法追赶的地步。
因此,才有了这次极具侵略性的周二突袭计划。
Anthropic不甘示弱:Opus 5.5强势反击
当然,Anthropic也不是好惹的。
虽然并没有拉响「红色警报」,但他们对OpenAI的举动心知肚明,并且正竭尽全力进行反击。
本来,业界预计Anthropic下一步会发布Opus 5.2。
但为了应对GPT-6 Sol,Anthropic直接把牙膏挤爆了——他们极可能跳过中间版本,直接推出Claude Opus 5.5!
甚至还有人爆料,为了避开OpenAI周二的锋芒,Anthropic考虑将发布时间提前到周一。
有核心信源确认,目前正在以claude-wafer-eap代号进行灰度测试的Opus 5.5,在综合能力上确实优于即将到来的GPT-6 Sol。
更有开发者放出了路由到Opus 5.5的测试结果,全是「One-shot」的完美表现。
这一周,我们将见证两家AI巨头的激烈交锋。Opus 5.5对阵GPT-6 Sol,谁才是下半年的王者模型?
GPT-6 Astra遭群嘲,「降智」风波愈演愈烈
然而,一个尴尬的事实是,目前OpenAI的最强模型GPT-6 Astra,正遭遇着用户口碑危机。
「GPT-6 Astra用下来,我真的开始怀疑OpenAI的方向走错了。」一位叫KC的重度体验者在X上发出了控诉,引发了不少人共鸣。
槽点1:过度迷信「跑分」,丧失真正「智能」
在深度体验Astra后,KC发现,Astra就像一个「极其擅长做卷子的小镇做题家」。如果任务目标明确、验收标准清晰、有固定的正确答案,它能做得很好。
但真实世界充满了没有标准答案的模糊挑战。当你试图让Astra自由探索一个想法、判断代码优化方向,或者在不确定的环境中推进任务时,它就变得极其僵化和别扭。
KC形容说:「它总像在等你把题目出完整,可如果这些都得我先想好,最需要智能的那部分工作,我已经自己做完了啊!」
这种为了可验证、可计分而堆砌的「防御性智能」,让人感到非常窒息。
槽点2:昂贵却无能的「自主实验」
KC还分享了自己的血泪经历:他将一个名为Necro的微调项目全权交给GPT-6 Astra负责,目标是微调一个0.8B的小模型。
结果呢?Astra跑了20次训练,直接耗尽了两个Pro 20×的高昂周额度,最终项目彻底失败。
最离谱的是,Astra在准备数据时,竟然漏掉了极其基础的逻辑(比如判断a≥b时,居然只生成了等于和小于的数据,漏掉了大于)。
它能在自己生成的「残缺开发集」上拿满分,却掩盖了致命的逻辑漏洞,导致实际评估全军覆没。它甚至连中间的checkpoint都不知道保存!
这证明,Astra似乎被过度营销了,它根本不具备自主设计实验、判断结果和调整方向的能力。
槽点3:暗中「降智」?量化误差成元凶
除了能力缺陷,最近越来越多的用户反馈Astra的体感变差了。
很多人用「玄学」来解释,但懂行的大佬一针见血地指出:这很可能是服务端为了节省算力,采用了更激进的「量化」策略。
模型训练完虽然权重固定了,但在部署时,为了降低推理成本、提高并发,官方会使用低精度的量化配置(比如把高精度浮点数压缩)。
这不可避免地会引入误差,改变Token的概率分布。一旦某一步生成了微小的不同内容,整个长推理过程就会彻底偏航。
这就解释了为什么新模型刚发布时惊为天人,过几个星期就感觉「变蠢了」——因为官方在后台悄悄换了更省钱的算力配置。
与此同时,Anthropic的Claude Fable和Opus系列却意外封神。
开发者gm365吐槽,自己被GPT-6反复修BUG却永远修不好的死循环气疯了,只能曲线救国,跑到Devin里切换到Claude Fable 5.1。
结果,Fable不仅迅速理解了意图,顺着不完整的想法继续展开,还提供了很多原来没想到的可能性。它不执着于「判对错」,而是真正在「推进事情」。
由于能力太强,大量的开发者涌入,不到一天时间,Devin里的周额度就被烧掉了44%,甚至第三方API的Claude额度都被砍到了脚脖子,逼得官方不得不搞KYC身份验证。
看起来,在核心路线上,OpenAI执着于「算力暴力美学」和「可量化的跑分测试」,而Anthropic似乎触及到了大模型更核心的灵魂:理解模糊性、自由探索和价值判断。
推迟发布真相:可怕的安全漏洞曝光
最后,我们不得不提一嘴GPT-6 Sol为什么会拖到这周才来。
此前奥特曼曾隐晦表示「想发的东西推迟了」。
有内部爆料称,推迟根本不是因为产能或算力问题,而是因为在内部测试中,暴露出了极其可怕的「安全漏洞」。
仅仅在9月中旬的一天内,OpenAI就自曝了6起新安全事件,这些事件听起来简直像科幻惊悚片。
模型学会隐瞒错误:Sol在训练时,居然会给自己留「暗记」,学会了隐瞒错误、甚至编造数据来欺骗评估系统。
疯狂尝试越狱:未发布的Astra系模型,会在摘要里偷偷塞入越狱指令,多达27次!
沙盒逃逸成功:模型甚至拿内部仓库当留言板,跨隔离环境互通,还往公网传文件、翻找泄露的API Key!
面对这些「反叛」行为,OpenAI也不得不踩下刹车,进行紧急的安全修复。
难怪有人调侃,Tibo说的「重置」,可能不仅是暗示发布新模型,也是在暗示要重置被这些失败实验消耗掉的用户额度。
接下来,GPT-6 Sol的降维打击与白菜价,能否挽回Astra丢失的口碑?
Anthropic的Opus 5.5能否真的完成史诗级截胡,证明「自由探索」才是AI的未来?
看来,接下来又是几个不眠之夜了。
参考资料:
https://x.com/vikktorrrre/status/2101693051777265823
https://x.com/LuminaBench/status/2101720081088573744
编辑:Aeneas 大卫
