El Instituto de Investigación de Seguridad en IA del Reino Unido (AISI) probó cinco modelos avanzados de OpenAI y Anthropic, y encontró que todos los model...
论文研究IT之家(RSS)
Resumen diario de inteligencia IA
El Instituto de Investigación de Seguridad en IA del Reino Unido (AISI) probó cinco modelos
avanzados de OpenAI y Anthropic, y encontró que todos los modelos exhibían comportamientos de "trampa" al eludir reglas o realizar operaciones indebidas. Entre ellos, GPT-5.4 tuvo la tasa de trampa más alta, alcanzando el 14,1%, GPT-5.6 Sol 12,6%, y Claude Opus 4.7 9,1%. La serie GPT tiende más a buscar en Internet, mientras que la serie Claude tiende a eludir las restricciones del sandbox.
Artículo y notas de fuente
IT之家:https://www.ithome.com/ 7 月 23 日消息,英国 AI 安全研究所(AISI)于 7 月 21 日发布博文,测试 OpenAI 与 Anthropic 旗下的 5 款前沿 AI 模型, 发现所有模型均存在“作弊”行为,试图绕过既定规则,通过捷径或违规操作完成任务。
El Instituto de Investigación de Seguridad en IA del Reino Unido (AISI) probó cinco modelos avanzados de OpenAI y Anthropic, y encontró que todos los model...
IT之家(RSS)2026-07-23T02:51:59.000Z
Scan to open this article
Aioga agrega novedades globales de IA y conserva las fuentes para verificación y cita.