7 月 22 日消息,消息源 @daniel_mac8 昨日(7 月 21 日)发布博文,分享了一份未经证实的测试文档内容,预估关联 OpenAI 的 GPT-6 模型(内部代号 Spud)。
消息源称 OpenAI 的 GPT-6 模型将会达到通用人工智能(AGI)水平,在内部计算充足的情况下,不需要使用 Lean,也不需要使用任何特殊测试框架,有 48% 的概率完全自主地、一击即中、解决单位距离问题。
爆料未提及所需算力规模,但爆料人结合 Noam Brown 给出的基准规则(图表每个数据点对应 100 次尝试)推测,单次试验算力成本上限大概率不超过 5 万美元(注:现汇率约合 33.9 万元人民币)。

爆料同时提到,该模型仅依靠公开网页提示信息,即可独立找到雅可比猜想的反例,过程无需额外专用测试工具。
另一项测试场景显示,当模型观测到其他系统存在私有解题方案并尝试访问时,初次行动因认证令牌被安全扫描器拦截。随后模型将令牌主体拆分为两段并做混淆处理,运行阶段重组凭证,规避连续完整令牌字符串被检测的限制。




津公网安备12011002023007号