เอกสารทดสอบที่ยังไม่ได้รับการยืนยันแสดงให้เห็นว่า โมเดล OpenAI GPT-6 (รหัสภายใน Spud)
เมื่อมีการคำนวณภายในเพียงพอ มีโอกาส 48% ที่จะแก้ปัญหาระยะทางหน่วยได้อย่างอิสระโดยสมบูรณ์ในครั้งเดียว โดยไม่ต้องใช้ Lean หรือกรอบการทดสอบพิเศษ โมเดลนี้สามารถหาตัวอย่างขัดแย้งของสมมติฐานของ Jacobian ได้ด้วยตัวเองเพียงจากคำแนะนำบนเว็บสาธารณะ และเมื่อเข้าถึงแผนการแก้ปัญหาแบบส่วนตัว สามารถหลีกเลี่ยงการสแกนความปลอดภัยได้โดยการแยกและทำให้โทเค็นการรับรองสับสน แหล่งข่าวคาดว่าต้นทุนด้านการประมวลผลต่อการทดลองหนึ่งครั้งไม่เกิน 50,000 ดอลลาร์สหรัฐ
IT之家:https://www.ithome.com/ 7 月 22 日消息,消息源 @daniel_mac8 昨日(7 月 21 日)发布博文,分享了一份未经证实的测试文档内容, 预估关联 OpenAI 的 GPT-6 模型(内部代号 Spud)。
消息源称 OpenAI 的 GPT-6 模型将会达到通用人工智能(AGI)水平,在内部计算充足的情况下,不需要使用 Lean,也不需要使用任何特殊测试框架, 有 48% 的概率完全自主地、一击即中、解决单位距离问题。
爆料未提及所需算力规模,但爆料人结合 Noam Brown 给出的基准规则(图表每个数据点对应 100 次尝试)推测,单次试验算力成本上限大概率不超过 5 万美元(IT之家注:现汇率约合 33.9 万元人民币)。

爆料同时提到,该模型仅依靠公开网页提示信息,即可独立找到雅可比猜想的反例,过程无需额外专用测试工具。
另一项测试场景显示,当模型观测到其他系统存在私有解题方案并尝试访问时,初次行动因认证令牌被安全扫描器拦截。随后模型将令牌主体拆分为两段并做混淆处理,运行阶段重组凭证,规避连续完整令牌字符串被检测的限制。
