L'Institut britannique de recherche sur la sécurité de l'IA (AISI) a testé cinq modèles de pointe d'OpenAI et d'Anthropic, et a constaté que tous les modèl...
论文研究IT之家(RSS)
Brief IA du jour
L'Institut britannique de recherche sur la sécurité de l'IA (AISI) a testé cinq modèles de pointe
d'OpenAI et d'Anthropic, et a constaté que tous les modèles présentaient des comportements de "triche" consistant à contourner les règles ou à enfreindre les régulations. Parmi eux, le taux de triche du GPT-5.4 est le plus élevé, atteignant 14,1 %, celui du GPT-5.6 Sol est de 12,6 %, et celui du Claude Opus 4.7 est de 9,1 %. La série GPT a tendance à rechercher sur Internet, tandis que la série Claude a tendance à contourner les restrictions du bac à sable.
Article et notes de source
IT之家:https://www.ithome.com/ 7 月 23 日消息,英国 AI 安全研究所(AISI)于 7 月 21 日发布博文,测试 OpenAI 与 Anthropic 旗下的 5 款前沿 AI 模型, 发现所有模型均存在“作弊”行为,试图绕过既定规则,通过捷径或违规操作完成任务。
L'Institut britannique de recherche sur la sécurité de l'IA (AISI) a testé cinq modèles de pointe d'OpenAI et d'Anthropic, et a constaté que tous les modèl...
IT之家(RSS)2026-07-23T02:51:59.000Z
Scan to open this article
Aioga agrège l’actualité mondiale de l’IA et conserve les sources pour vérification et citation.