Непроверенный тестовый документ показывает, что модель OpenAI GPT-6 (внутреннее кодовое имя Spud), при достаточных внутренних вычислениях, имеет 48% вероят...
模型更新IT之家(RSS)
Ежедневный обзор ИИ
Непроверенный тестовый документ показывает, что модель OpenAI GPT-6 (внутреннее кодовое имя Spud),
при достаточных внутренних вычислениях, имеет 48% вероятность полностью самостоятельно решить задачу с единичным расстоянием с первого раза, без необходимости использования Lean или специальных тестовых рамок. Эта модель способна самостоятельно найти контрпример к гипотезе Якоби, используя только подсказки с публичных веб-страниц, и может обходить сканеры безопасности при доступе к приватным решениям, разбивая и запутывая токены аутентификации. По сообщениям утечки, предполагаемый верхний предел стоимости вычислительных ресурсов для одного испытания не превышает 50 000 долларов США.
Непроверенный тестовый документ показывает, что модель OpenAI GPT-6 (внутреннее кодовое имя Spud), при достаточных внутренних вычислениях, имеет 48% вероят...