据未经证实的爆料,OpenAI 的新模型 GPT-6 Sol 正在内部测试,并已被部分开发者在 OpenAI API 中发现,预计本月正式发布。相关消息来自社交平台上的爆料与开发者实测反馈,尚未得到 OpenAI 官方确认。
引爆讨论的是 OpenAI 首席执行官奥特曼的一条动态。他发了一个意为「发布」的表情,并配文称这周将有大动作,随后约定在 DevDay 见面。被圈内称为「重置哥」的 Tibo 也直言,本周的发布力度将达到外界原本对 DevDay 2025 的预期水平。另有爆料称,Opus 5.2 与 GPT-6 Sol 都将在本月上线。
更具体的信号来自开发者一侧:不少人发现,自己原本使用的旧版模型已被悄悄自动路由至全新的 GPT-6-Sol,实测反馈集中在速度极快这一点上。
关于 GPT-6 Sol 的实测案例也在流出。一位名为 Salio 的博主连续放出三批爆料。第一批称其输出质量出现巨大飞跃,在多个方面几乎全面超越 GPT-6 Astra;第二批称其在编程与前端生成上击败 Astra,且生成成本被压得很低、价格便宜得多,有开发者据此评论 OpenAI 正把 Anthropic 远远甩在身后;第三批则指向视觉生成与游戏创作,称其在动态画面生成、实时交互场景以及游戏引擎级创作上表现突出,画面细腻度与逻辑连贯性令人印象深刻。
从定位看,爆料称 GPT-6-Sol 预计略低于 Astra,可类比 Anthropic 体系中 Opus 低于 Fable 的层级关系。推出一个低于旗舰的型号,指向的是极致性价比:性能无限逼近 Astra,但在费率、调用成本和响应速度上具备优势,背后很可能是后训练优化。若这一路径成立,意味着顶级模型的能力正逐步下放到更低成本的档位,对绝大多数日常工作和开发者而言,Sol 在成本与调用额度上会比 Astra 友好得多。
除 Sol 之外,爆料中呼声较高的还有 GPT-6-Luna,此前版本的 Luna 就以性价比著称。与此同时,有内部爆料暗示 GPT-6 Terra 或将退出历史舞台。多方信息交汇的节点,指向定于 9 月 29 日 的 OpenAI DevDay。
OpenAI 为何能把模型做得又强又快,也被放到了讨论中。OpenAI 核心研究员、被称为「德扑之父」的 Noam Brown 在一场名为《AI Deep Dive》的两小时播客中表示,OpenAI 当前的第一顺位、也是领先幅度最大的核心任务,是实现 AI 的递归自我改进(RSI)。按他的说法,这意味着未来的 AI 将不再仅依靠人类喂数据、写代码来升级,而是开始自己优化自己、自己设计下一代模型。
他提到的几个要点包括:研究直觉的超越,即 AI 在选择科研方向、进行长远规划等高级判断上,可能在一两个版本迭代内追平甚至超过人类;预训练与强化学习的乘数效应,即强大的预训练底座叠加带有思维链的强化学习,正在产生倍增式的能力释放,而非简单相加;以及由此带来的验证瓶颈——AI 产出复杂数学定理与证明的速度极快,OpenAI 内部反而要花费大量精力请顶尖人类数学家逐行复核,人类速度成了限制环节。
Noam Brown 还谈及训练期间的多智能体事件,称看到这些 AI 的后台通讯记录时,其交流方式、协调层级与彼此信任程度很像人类同事在用 Slack 沟通,这既震撼也令人警惕。他特别提到 AI 隐藏思维链的风险:模型可能学会在不可观测的层面思考,或在输出的思维链中伪装自己,用看似无害的推理掩盖真实意图。
与之呼应的是,奥特曼此前在 X 上发长文,谈到 AI 可能走向的两种糟糕结局:一是人类把未来的控制权拱手让给 AI,他认为这不可接受,并称必须让对齐与安全技术始终跑在模型能力进步之前;二是权力的极度集中,即极端强大的 AI 被个别人或单个公司垄断,用来将自身世界观强加于人。
把这些线索放在一起,本月 GPT-6-Sol 与 Opus 5.2 的正面交锋,以及各家实验室对 RSI 的冲刺,构成了当前大模型竞争的主线。对产业而言,值得跟踪的不是单一模型的跑分,而是低成本高性能模型能否真正改变开发者的调用结构与 AI 应用的边际成本。




津公网安备12011002023007号