{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-07-23T06:40:50.084Z","headline":"OpenAI 发布 GPT-Red：通过自动化红队测试提升模型鲁棒性","description":"OpenAI 训练了自动化红队模型 GPT-Red，用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型，其攻击被用于对抗训练 GPT-5.6 Sol，使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练，投入了 OpenAI 后训练中前所未有的计算规模。","url":"https://www.aioga.com/news/cmrmc527c0088bivcfrd3s2uz/","mainEntityOfPage":"https://www.aioga.com/news/cmrmc527c0088bivcfrd3s2uz/","datePublished":"2026-07-15T10:00:00.000Z","dateModified":"2026-07-15T10:00:00.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://openai.com/index/unlocking-self-improvement-gpt-red","https://aihot.virxact.com/items/cmrmc527c0088bivcfrd3s2uz"],"canonicalUrl":"https://www.aioga.com/news/cmrmc527c0088bivcfrd3s2uz/","directAnswer":{"@type":"Answer","text":"OpenAI 发布自动化红队模型 GPT-Red，用于部署前发现漏洞，并在训练阶段生成攻击样本。其攻击被用于对抗训练 GPT-5.6 Sol，以提升模型面对直接提示注入时的鲁棒性。","url":"https://www.aioga.com/news/cmrmc527c0088bivcfrd3s2uz/","dateCreated":"2026-07-15T10:00:00.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"OpenAI source article","url":"https://openai.com/index/unlocking-self-improvement-gpt-red","datePublished":"2026-07-15T10:00:00.000Z","provider":{"@type":"Organization","name":"OpenAI","url":"https://openai.com/index/unlocking-self-improvement-gpt-red"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.virxact.com/items/cmrmc527c0088bivcfrd3s2uz","datePublished":"2026-07-15T10:00:00.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.virxact.com/items/cmrmc527c0088bivcfrd3s2uz"}}],"aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","originalPublisher":{"name":"OpenAI","url":"https://openai.com/index/unlocking-self-improvement-gpt-red"},"article":{"id":"cmrmc527c0088bivcfrd3s2uz","slug":"cmrmc527c0088bivcfrd3s2uz","url":"https://www.aioga.com/news/cmrmc527c0088bivcfrd3s2uz/","title":"OpenAI 发布 GPT-Red：通过自动化红队测试提升模型鲁棒性","title_en":"GPT-Red： Unlocking Self-Improvement for Robustness","summary":"OpenAI 训练了自动化红队模型 GPT-Red，用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型，其攻击被用于对抗训练 GPT-5.6 Sol，使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练，投入了 OpenAI 后训练中前所未有的计算规模。","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","sourceUrl":"https://openai.com/index/unlocking-self-improvement-gpt-red","aiHotUrl":"https://aihot.virxact.com/items/cmrmc527c0088bivcfrd3s2uz","publishedAt":"2026-07-15T10:00:00.000Z","category":"模型更新","score":67,"selected":true,"articleBody":["OpenAI 训练了自动化红队模型 GPT-Red，用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。","GPT-Red 能攻破此前几乎所有模型，其攻击被用于对抗训练 GPT-5.6 Sol，使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。","GPT-Red 通过自对弈强化学习训练，投入了 OpenAI 后训练中前所未有的计算规模。"],"articleImages":[],"mediaStatus":"none","articleBodyZh":[],"translationStatus":"","bodyOrigin":"summary-fallback","editorial":{"summary":"OpenAI 发布自动化红队模型 GPT-Red，用于部署前发现漏洞，并在训练阶段生成攻击样本。其攻击被用于对抗训练 GPT-5.6 Sol，以提升模型面对直接提示注入时的鲁棒性。","background":"公开材料显示，GPT-Red 采用自对弈强化学习训练，使用了 OpenAI 后训练中前所未有的计算规模。该模型能够攻破此前几乎所有模型，为后续对抗训练提供攻击样本。","viewpoint":"Aioga 判断，GPT-Red 的重点不只是自动发现漏洞，而是把红队攻击直接纳入模型训练流程，使安全测试与鲁棒性改进形成更紧密的迭代机制。","implications":"值得关注的是，GPT-5.6 Sol 在直接提示注入基准测试中的失败率，已降至四个月前最佳生产模型的六分之一。这可能表明自动化攻击样本对特定安全训练具有实际价值。","nextStep":"后续值得关注 OpenAI 是否披露更完整的基准设置、失败率口径与跨模型测试结果，以及 GPT-Red 在部署前评估和训练阶段的具体使用方式，以判断其效果能否稳定延伸到更多场景。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-07-23T02:10:34.519Z","sourceHash":"3d85c944dd3355b9","review":{"approved":true,"groundedness":96,"clarity":91,"duplicationRisk":24,"blockingIssues":[],"notes":["“summary”与“background”均提到 GPT-Red 生成攻击样本并用于对抗训练，存在轻微信息重复，但不影响审核通过。","“viewpoint”已明确标注为 Aioga 的判断，“implications”也使用“可能表明”限定推论，未将观点冒充为来源事实。","可在提及失败率时注明该结果来自 OpenAI 披露的基准测试，以进一步强化信息归属。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","low-source-overlap","no-html","independent-ai-review"]}},"tags":["模型更新","OpenAI：官网动态（RSS · 排除企业/客户案例）"],"translations":{"zh-CN":{"title":"OpenAI 发布 GPT-Red：通过自动化红队测试提升模型鲁棒性","summary":"OpenAI 训练了自动化红队模型 GPT-Red，用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型，其攻击被用于对抗训练 GPT-5.6 Sol，使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练，投入了 OpenAI 后训练中前所未有的计算规模。","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI 发布 GPT-Red：通过自动化红队测试提升模型鲁棒性 - Aioga AI资讯","description":"OpenAI 训练了自动化红队模型 GPT-Red，用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型，其攻击被用于对抗训练 GPT-5.6 Sol，使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练，投入了 OpenAI 后训练中前所未有的计算规模。","url":"https://www.aioga.com/news/cmrmc527c0088bivcfrd3s2uz/"},"en":{"title":"OpenAI Releases GPT-Red: Enhancing Model Robustness Through Automated Red-Team Testing","summary":"OpenAI trained the automated red-team model GPT-Red to discover vulnerabilities before deployment and generate attacks during training to enhance model robustness. GPT-Red can breach almost all previous models, and its attacks were used against training GPT-5.6 Sol, reducing its failure rate in direct prompt injection benchmarks to one-sixth of the best production model four months ago. GPT-Red has achieved an unprecedented scale of computation in OpenAI's training through auto-reinforcement learning training.","category":"Models","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI Releases GPT-Red: Enhancing Model Robustness Through Automated Red-Team Testing - Aioga AI News","description":"OpenAI trained the automated red-team model GPT-Red to discover vulnerabilities before deployment and generate attacks during training to enhance model robustness. GPT-Red can brea","url":"https://www.aioga.com/en/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:06.771Z"},"ja":{"title":"OpenAIがGPT-Redをリリース:自動レッドチームテストによるモデルの堅牢性強化","summary":"OpenAIは自動化されたレッドチームモデルGPT-Redを訓練し、展開前に脆弱性を発見し、トレーニング中に攻撃を生成してモデルの堅牢性を高めました。 GPT-Redはほぼすべての従来のモデルを突破可能であり、その攻撃はGPT-5.6 Solのトレーニングにも使われ、4か月前には直接プロンプトインジェクションの失敗率を最高の生産モデルの6分の1にまで削減しました。 GPT-Redは、Auto-reforcement learningトレーニングを通じてOpenAIのトレーニングにおいて前例のない計算規模を実現しました。","category":"モデル更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAIがGPT-Redをリリース:自動レッドチームテストによるモデルの堅牢性強化 - Aioga AIニュース","description":"OpenAIは自動化されたレッドチームモデルGPT-Redを訓練し、展開前に脆弱性を発見し、トレーニング中に攻撃を生成してモデルの堅牢性を高めました。 GPT-Redはほぼすべての従来のモデルを突破可能であり、その攻撃はGPT-5.6 Solのトレーニングにも使われ、4か月前には直接プロンプトインジェクションの失敗率を最高の生産モデルの6分の1にまで削減しま","url":"https://www.aioga.com/ja/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:06.879Z"},"ko":{"title":"OpenAI가 GPT-Red 발표: 자동화된 레드팀 테스트를 통한 모델의 견고성 강화","summary":"OpenAI는 자동화된 레드팀 모델 GPT-Red를 훈련시켜 배포 전에 취약점을 발견하고 훈련 중 공격을 생성하여 모델의 견고성을 강화했습니다. GPT-Red는 거의 모든 이전 모델을 뚫을 수 있으며, 이 공격은 GPT-5.6 Sol 훈련에 사용되어 4개월 전 직접 프로프트 인젝션 벤치마크에서 실패율을 최고의 생산 모델의 6분의 1로 낮췄습니다. GPT-Red는 자동강화학습 훈련을 통해 OpenAI 훈련에서 전례 없는 연산 규모를 달성했습니다.","category":"모델 업데이트","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI가 GPT-Red 발표: 자동화된 레드팀 테스트를 통한 모델의 견고성 강화 - Aioga AI 뉴스","description":"OpenAI는 자동화된 레드팀 모델 GPT-Red를 훈련시켜 배포 전에 취약점을 발견하고 훈련 중 공격을 생성하여 모델의 견고성을 강화했습니다. GPT-Red는 거의 모든 이전 모델을 뚫을 수 있으며, 이 공격은 GPT-5.6 Sol 훈련에 사용되어 4개월 전 직접 프로프트 인젝션 벤치마크에서 실패율을 최고의 생산 모델의","url":"https://www.aioga.com/ko/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:06.890Z"},"es":{"title":"OpenAI publica GPT-Red: Mejorando la robustez de los modelos mediante pruebas automatizadas de equipos rojos","summary":"OpenAI entrenó al modelo automatizado de equipo rojo GPT-Red para descubrir vulnerabilidades antes del despliegue y generar ataques durante el entrenamiento para mejorar la robustez del modelo. GPT-Red puede superar casi todos los modelos anteriores, y sus ataques se utilizaron contra el entrenamiento de GPT-5.6 Sol, reduciendo su tasa de fallos en benchmarks de inyección directa rápida a una sexta parte del mejor modelo de producción hace cuatro meses. GPT-Red ha logrado una escala de cálculo sin precedentes en el entrenamiento de OpenAI mediante aprendizaje por refuerzo automático.","category":"Modelos","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI publica GPT-Red: Mejorando la robustez de los modelos mediante pruebas automatizadas de equipos rojos - Aioga Noticias de IA","description":"OpenAI entrenó al modelo automatizado de equipo rojo GPT-Red para descubrir vulnerabilidades antes del despliegue y generar ataques durante el entrenamiento para mejorar la robuste","url":"https://www.aioga.com/es/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:06.851Z"},"fr":{"title":"OpenAI publie GPT-Red : Améliorer la robustesse des modèles grâce aux tests automatisés de l’équipe rouge","summary":"OpenAI a entraîné le modèle automatisé de red-team GPT-Red à découvrir les vulnérabilités avant le déploiement et à générer des attaques pendant la formation afin d’améliorer la robustesse du modèle. GPT-Red peut franchir presque tous les modèles précédents, et ses attaques ont été utilisées contre l’entraînement du GPT-5.6 Sol, réduisant son taux de défaillance dans les benchmarks d’injection directe rapide à un sixième du meilleur modèle de production il y a quatre mois. GPT-Red a atteint une échelle de calcul sans précédent dans l’entraînement d’OpenAI grâce à l’apprentissage par renforcement automatique.","category":"Modèles","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI publie GPT-Red : Améliorer la robustesse des modèles grâce aux tests automatisés de l’équipe rouge - Aioga Actualités IA","description":"OpenAI a entraîné le modèle automatisé de red-team GPT-Red à découvrir les vulnérabilités avant le déploiement et à générer des attaques pendant la formation afin d’améliorer la ro","url":"https://www.aioga.com/fr/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:06.992Z"},"de":{"title":"OpenAI veröffentlicht GPT-Red: Verbesserung der Modellrobustheit durch automatisiertes Red-Team-Testing","summary":"OpenAI trainierte das automatisierte Red-Team-Modell GPT-Red, um Schwachstellen vor der Bereitstellung zu erkennen und während des Trainings Angriffe zu generieren, um die Modellrobustheit zu verbessern. GPT-Red kann fast alle vorherigen Modelle durchbrechen, und seine Angriffe wurden gegen das Training von GPT-5.6 Sol eingesetzt, wodurch die Ausfallquote bei direkten Prompt-Injection-Benchmarks auf ein Sechstel des besten Produktionsmodells vor vier Monaten reduziert wurde. GPT-Red hat eine beispiellose Rechenleistung im Training von OpenAI durch Auto-Reinforcement Learning erreicht.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI veröffentlicht GPT-Red: Verbesserung der Modellrobustheit durch automatisiertes Red-Team-Testing - Aioga KI-News","description":"OpenAI trainierte das automatisierte Red-Team-Modell GPT-Red, um Schwachstellen vor der Bereitstellung zu erkennen und während des Trainings Angriffe zu generieren, um die Modellro","url":"https://www.aioga.com/de/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.157Z"},"pt-BR":{"title":"OpenAI lança GPT-Red: Aprimorando a robustez do modelo por meio de testes automatizados de red-team","summary":"A OpenAI treinou o modelo automatizado de equipe vermelha GPT-Red para descobrir vulnerabilidades antes da implantação e gerar ataques durante o treinamento para aumentar a robustez do modelo. O GPT-Red pode violar quase todos os modelos anteriores, e seus ataques foram usados contra o treinamento do GPT-5.6 Sol, reduzindo sua taxa de falha nos benchmarks de injeção rápida direta para um sexto do melhor modelo de produção há quatro meses. O GPT-Red alcançou uma escala de computação sem precedentes no treinamento da OpenAI por meio do treinamento de aprendizado por reforço automático.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI lança GPT-Red: Aprimorando a robustez do modelo por meio de testes automatizados de red-team - Aioga Notícias de IA","description":"A OpenAI treinou o modelo automatizado de equipe vermelha GPT-Red para descobrir vulnerabilidades antes da implantação e gerar ataques durante o treinamento para aumentar a robuste","url":"https://www.aioga.com/pt-BR/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:10.009Z"},"ru":{"title":"OpenAI выпускает GPT-Red: повышение устойчивости модели с помощью автоматизированного тестирования красной команды","summary":"OpenAI обучила автоматизированную модель красной команды GPT-Red выявлять уязвимости до развертывания и генерировать атаки во время обучения для повышения устойчивости модели. GPT-Red способен взломать почти все предыдущие модели, а его атаки были использованы против тренировочного GPT-5.6 Sol, что снизило уровень отказов в бенчмарках прямого prompt injection до одной шести лучшей серийной модели четыре месяца назад. GPT-Red достиг беспрецедентного масштаба вычислений в обучении OpenAI благодаря обучению с автоматическим подкреплением.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI выпускает GPT-Red: повышение устойчивости модели с помощью автоматизированного тестирования красной команды - Aioga Новости ИИ","description":"OpenAI обучила автоматизированную модель красной команды GPT-Red выявлять уязвимости до развертывания и генерировать атаки во время обучения для повышения устойчивости модели. GPT-","url":"https://www.aioga.com/ru/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.342Z"},"ar":{"title":"OpenAI تصدر GPT-Red: تعزيز متانة النموذج من خلال اختبار الفريق الأحمر الآلي","summary":"قامت OpenAI بتدريب نموذج الفريق الأحمر الآلي GPT-Red على اكتشاف الثغرات قبل النشر وتوليد هجمات أثناء التدريب لتعزيز متانة النموذج. GPT-Red يمكنه اختراق معظم الطرازات السابقة، وقد استخدمت هجماته ضد تدريب GPT-5.6 Sol، مما خفض معدل فشله في معايير حقن الأوامر المباشرة إلى سدس أفضل نموذج إنتاج قبل أربعة أشهر. حقق GPT-Red مستوى غير مسبوق من الحوسبة في تدريب OpenAI من خلال تدريب التعلم المعزز التلقائي.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI تصدر GPT-Red: تعزيز متانة النموذج من خلال اختبار الفريق الأحمر الآلي - Aioga أخبار الذكاء الاصطناعي","description":"قامت OpenAI بتدريب نموذج الفريق الأحمر الآلي GPT-Red على اكتشاف الثغرات قبل النشر وتوليد هجمات أثناء التدريب لتعزيز متانة النموذج. GPT-Red يمكنه اختراق معظم الطرازات السابقة، وقد ا","url":"https://www.aioga.com/ar/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.423Z"},"hi":{"title":"OpenAI ने GPT-Red जारी किया: स्वचालित रेड-टीम परीक्षण के माध्यम से मॉडल की मजबूती को बढ़ाना","summary":"OpenAI ने स्वचालित रेड-टीम मॉडल GPT-Red को तैनात करने से पहले कमजोरियों का पता लगाने और मॉडल की मजबूती बढ़ाने के लिए प्रशिक्षण के दौरान हमले उत्पन्न करने के लिए प्रशिक्षित किया। GPT-Red लगभग सभी पिछले मॉडलों का उल्लंघन कर सकता है, और इसके हमलों का उपयोग GPT-5.6 Sol को प्रशिक्षित करने के खिलाफ किया गया था, जिससे चार महीने पहले प्रत्यक्ष प्रॉम्प्ट इंजेक्शन बेंचमार्क में इसकी विफलता दर सर्वश्रेष्ठ उत्पादन मॉडल के छठे हिस्से तक कम हो गई थी। GPT-Red ने ऑटो-सुदृढीकरण शिक्षण प्रशिक्षण के माध्यम से OpenAI के प्रशिक्षण में गणना का एक अभूतपूर्व पैमाना हासिल किया है।","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI ने GPT-Red जारी किया: स्वचालित रेड-टीम परीक्षण के माध्यम से मॉडल की मजबूती को बढ़ाना - Aioga AI समाचार","description":"OpenAI ने स्वचालित रेड-टीम मॉडल GPT-Red को तैनात करने से पहले कमजोरियों का पता लगाने और मॉडल की मजबूती बढ़ाने के लिए प्रशिक्षण के दौरान हमले उत्पन्न करने के लिए प्रशिक्षित किया। GP","url":"https://www.aioga.com/hi/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.014Z"},"it":{"title":"OpenAI rilascia GPT-Red: migliorare la robustezza dei modelli attraverso test automatizzati del red-team","summary":"OpenAI ha addestrato il modello automatizzato del red-team GPT-Red a scoprire vulnerabilità prima del deployment e a generare attacchi durante l'addestramento per aumentare la robustezza del modello. GPT-Red può superare quasi tutti i modelli precedenti, e i suoi attacchi sono stati utilizzati contro l'addestramento del GPT-5.6 Sol, riducendo il suo tasso di guasto nei benchmark di iniezione immediata diretta a un sesto del miglior modello di produzione di quattro mesi fa. GPT-Red ha raggiunto una scala di calcolo senza precedenti nell'addestramento di OpenAI tramite l'auto-reinforcement learning.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI rilascia GPT-Red: migliorare la robustezza dei modelli attraverso test automatizzati del red-team - Aioga Notizie IA","description":"OpenAI ha addestrato il modello automatizzato del red-team GPT-Red a scoprire vulnerabilità prima del deployment e a generare attacchi durante l'addestramento per aumentare la robu","url":"https://www.aioga.com/it/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:08.909Z"},"nl":{"title":"OpenAI brengt GPT-Red uit: Verbetering van modelrobuustheid door geautomatiseerd Red-team testen","summary":"OpenAI trainde het geautomatiseerde red-team model GPT-Red om kwetsbaarheden te ontdekken vóór de uitrol en tijdens de training aanvallen te genereren om de robuustheid van het model te verbeteren. GPT-Red kan bijna alle eerdere modellen binnendringen, en zijn aanvallen werden gebruikt tegen de training van GPT-5.6 Sol, waardoor het faalpercentage in directe prompt injectiebenchmarks vier maanden geleden werd teruggebracht tot een zesde van het beste productiemodel. GPT-Red heeft een ongekende schaal van rekenkrachten bereikt in OpenAI's training via auto-reinforcement learning-training.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI brengt GPT-Red uit: Verbetering van modelrobuustheid door geautomatiseerd Red-team testen - Aioga AI-nieuws","description":"OpenAI trainde het geautomatiseerde red-team model GPT-Red om kwetsbaarheden te ontdekken vóór de uitrol en tijdens de training aanvallen te genereren om de robuustheid van het mod","url":"https://www.aioga.com/nl/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:08.665Z"},"tr":{"title":"OpenAI, GPT-RED'i Yayınladı: Otomatik Kırmızı Takım Testi Yoluyla Model Dayanıklılığını Artırmak","summary":"OpenAI, otomatik kırmızı takım modeli GPT-Red'i, dağıtımdan önce güvenlik açıklarını keşfetmesi ve eğitim sırasında saldırılar oluşturarak model dayanıklılığını artırması için eğitti. GPT-Red neredeyse tüm önceki modelleri aşabiliyor ve saldırıları GPT-5.6 Sol'u eğitmeye yönelik olarak kullanıldı; bu da doğrudan çağrılı enjeksiyon benchmarklarında başarısızlık oranını dört ay önceki en iyi üretim modelinin altıda birine düşürdü. GPT-Red, otomatik pekiştirme öğrenme eğitimi sayesinde OpenAI'nin eğitiminde eşi benzeri görülmemiş bir hesaplama ölçeğine ulaşmıştır.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI, GPT-RED'i Yayınladı: Otomatik Kırmızı Takım Testi Yoluyla Model Dayanıklılığını Artırmak - Aioga AI Haberleri","description":"OpenAI, otomatik kırmızı takım modeli GPT-Red'i, dağıtımdan önce güvenlik açıklarını keşfetmesi ve eğitim sırasında saldırılar oluşturarak model dayanıklılığını artırması için eğit","url":"https://www.aioga.com/tr/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:08.512Z"},"vi":{"title":"OpenAI phát hành GPT-Red: Tăng cường độ mạnh mẽ của mô hình thông qua thử nghiệm đội đỏ tự động","summary":"OpenAI đã đào tạo mô hình đội đỏ tự động GPT-Red để phát hiện các lỗ hổng trước khi triển khai và tạo ra các cuộc tấn công trong quá trình đào tạo nhằm nâng cao tính mạnh mẽ của mô hình. GPT-Red có thể vi phạm hầu hết tất cả các mô hình trước đó và các cuộc tấn công của nó đã được sử dụng để huấn luyện GPT-5.6 Sol, giảm tỷ lệ thất bại trong các điểm chuẩn tiêm nhanh trực tiếp xuống còn một phần sáu so với mô hình sản xuất tốt nhất bốn tháng trước. GPT-Red đã đạt được quy mô tính toán chưa từng có trong đào tạo của OpenAI thông qua đào tạo học tăng cường tự động.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI phát hành GPT-Red: Tăng cường độ mạnh mẽ của mô hình thông qua thử nghiệm đội đỏ tự động - Tin tức AI Aioga","description":"OpenAI đã đào tạo mô hình đội đỏ tự động GPT-Red để phát hiện các lỗ hổng trước khi triển khai và tạo ra các cuộc tấn công trong quá trình đào tạo nhằm nâng cao tính mạnh mẽ của mô","url":"https://www.aioga.com/vi/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.658Z"},"id":{"title":"OpenAI Merilis GPT-Red: Meningkatkan Ketahanan Model Melalui Pengujian Red-Team Otomatis","summary":"OpenAI melatih model tim merah otomatis GPT-Red untuk menemukan kerentanan sebelum penerapan dan menghasilkan serangan selama pelatihan untuk meningkatkan ketahanan model. GPT-Red dapat menembus hampir semua model sebelumnya, dan serangannya digunakan untuk melatih GPT-5.6 Sol, mengurangi tingkat kegagalannya dalam tolok ukur injeksi cepat langsung menjadi seperenam dari model produksi terbaik empat bulan lalu. GPT-Red telah mencapai skala komputasi yang belum pernah terjadi sebelumnya dalam pelatihan OpenAI melalui pelatihan pembelajaran penguatan otomatis.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI Merilis GPT-Red: Meningkatkan Ketahanan Model Melalui Pengujian Red-Team Otomatis - Berita AI Aioga","description":"OpenAI melatih model tim merah otomatis GPT-Red untuk menemukan kerentanan sebelum penerapan dan menghasilkan serangan selama pelatihan untuk meningkatkan ketahanan model. GPT-Red ","url":"https://www.aioga.com/id/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.173Z"},"th":{"title":"OpenAI เปิดตัว GPT-Red: เพิ่มความแข็งแกร่งของโมเดลผ่านการทดสอบทีมสีแดงอัตโนมัติ","summary":"OpenAI ฝึกโมเดลทีมสีแดงอัตโนมัติ GPT-Red เพื่อค้นหาช่องโหว่ก่อนปรับใช้และสร้างการโจมตีระหว่างการฝึกอบรมเพื่อเพิ่มความแข็งแกร่งของโมเดล GPT-Red สามารถละเมิดโมเดลก่อนหน้าได้เกือบทั้งหมด และการโจมตีของมันถูกใช้กับการฝึก GPT-5.6 Sol ซึ่งลดอัตราความล้มเหลวในเกณฑ์มาตรฐานการฉีดพร้อมท์โดยตรงเหลือหนึ่งในหกของโมเดลการผลิตที่ดีที่สุดเมื่อสี่เดือนที่แล้ว GPT-Red ประสบความสําเร็จในการคํานวณในระดับที่ไม่เคยมีมาก่อนในการฝึกอบรมของ OpenAI ผ่านการฝึกอบรมการเรียนรู้แบบเสริมแรงอัตโนมัติ","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI เปิดตัว GPT-Red: เพิ่มความแข็งแกร่งของโมเดลผ่านการทดสอบทีมสีแดงอัตโนมัติ - ข่าว AI Aioga","description":"OpenAI ฝึกโมเดลทีมสีแดงอัตโนมัติ GPT-Red เพื่อค้นหาช่องโหว่ก่อนปรับใช้และสร้างการโจมตีระหว่างการฝึกอบรมเพื่อเพิ่มความแข็งแกร่งของโมเดล GPT-Red สามารถละเมิดโมเดลก่อนหน้าได้เกือบทั้ง","url":"https://www.aioga.com/th/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.044Z"},"pl":{"title":"OpenAI wypuszcza GPT-Red: Zwiększanie odporności modelu dzięki zautomatyzowanemu testowaniu zespołu Red-Team","summary":"OpenAI trenowało zautomatyzowany model zespołu czerwonego GPT-Red, aby wykrywać luki przed wdrożeniem i generować ataki podczas treningu, aby zwiększyć odporność modelu. GPT-Red może przełamać niemal wszystkie poprzednie modele, a jego ataki zostały użyte przeciwko treningowemu GPT-5.6 Sol, zmniejszając wskaźnik awarii w benchmarkach bezpośredniego prompt injection do jednej szóstej najlepszego modelu produkcyjnego cztery miesiące temu. GPT-Red osiągnął bezprecedensową skalę obliczeń w szkoleniach OpenAI dzięki szkoleniu z auto-wzmocnieniem.","category":"模型更新","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI wypuszcza GPT-Red: Zwiększanie odporności modelu dzięki zautomatyzowanemu testowaniu zespołu Red-Team - Aioga Wiadomości AI","description":"OpenAI trenowało zautomatyzowany model zespołu czerwonego GPT-Red, aby wykrywać luki przed wdrożeniem i generować ataki podczas treningu, aby zwiększyć odporność modelu. GPT-Red mo","url":"https://www.aioga.com/pl/news/cmrmc527c0088bivcfrd3s2uz/","contentTranslated":true,"sourceHash":"90c9861b655c7d79","translatedAt":"2026-07-19T16:46:09.413Z"}}}}