{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-09-18T17:00:43.709Z","headline":"OpenAI 发布模型错位披露框架，含3条审查路径和6份RL训练事故报告","description":"OpenAI 发布一套用于追踪、调查和公开披露自家模型错位行为的新框架，设定披露标准和时限，即使行为未被完全解释或修复也可披露，并同步发布6份初始事故报告。","url":"https://www.aioga.com/news/cmu58anil0324ro8tawwelc4v/","mainEntityOfPage":"https://www.aioga.com/news/cmu58anil0324ro8tawwelc4v/","datePublished":"2026-09-17T07:35:37.000Z","dateModified":"2026-09-17T07:35:37.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://www.marktechpost.com/2026/09/17/openai-releases-a-model-misalignment-disclosure-framework-with-3-review-tracks-and-6-incident-reports-from-rl-training","https://aihot.news/items/cmu58anil0324ro8tawwelc4v"],"canonicalUrl":"https://www.aioga.com/news/cmu58anil0324ro8tawwelc4v/","directAnswer":{"@type":"Answer","text":"OpenAI 发布模型错位披露框架，用于追踪、调查和公开披露自家模型的错位行为。框架设定披露标准与时限，即使行为尚未完全解释或缓解，也允许公开披露，并同步发布6份初始事故报告。","url":"https://www.aioga.com/news/cmu58anil0324ro8tawwelc4v/","dateCreated":"2026-09-17T07:35:37.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"marktechpost.com source article","url":"https://www.marktechpost.com/2026/09/17/openai-releases-a-model-misalignment-disclosure-framework-with-3-review-tracks-and-6-incident-reports-from-rl-training","datePublished":"2026-09-17T07:35:37.000Z","provider":{"@type":"Organization","name":"marktechpost.com","url":"https://www.marktechpost.com/2026/09/17/openai-releases-a-model-misalignment-disclosure-framework-with-3-review-tracks-and-6-incident-reports-from-rl-training"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.news/items/cmu58anil0324ro8tawwelc4v","datePublished":"2026-09-17T07:35:37.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.news/items/cmu58anil0324ro8tawwelc4v"}}],"aggregationSource":"MarkTechPost（RSS）","originalPublisher":{"name":"marktechpost.com","url":"https://www.marktechpost.com/2026/09/17/openai-releases-a-model-misalignment-disclosure-framework-with-3-review-tracks-and-6-incident-reports-from-rl-training"},"geoDeepAnswer":null,"article":{"id":"cmu58anil0324ro8tawwelc4v","slug":"cmu58anil0324ro8tawwelc4v","url":"https://www.aioga.com/news/cmu58anil0324ro8tawwelc4v/","title":"OpenAI 发布模型错位披露框架，含3条审查路径和6份RL训练事故报告","title_en":"","summary":"OpenAI 发布一套用于追踪、调查和公开披露自家模型错位行为的新框架，设定披露标准和时限，即使行为未被完全解释或修复也可披露，并同步发布6份初始事故报告。","source":"MarkTechPost（RSS）","sourceUrl":"https://www.marktechpost.com/2026/09/17/openai-releases-a-model-misalignment-disclosure-framework-with-3-review-tracks-and-6-incident-reports-from-rl-training","aiHotUrl":"https://aihot.news/items/cmu58anil0324ro8tawwelc4v","publishedAt":"2026-09-17T07:35:37.000Z","category":"行业动态","score":58,"selected":false,"articleBody":["OpenAI has released a new framework：https://openai.com/index/model-misalignment-reporting-framework/ for tracking, investigating, and disclosing misalignment in its own models. The OpenAI team announced it on X：https://x.com/OpenAI/status/2100344867507327087 alongside 6 detailed incident reports. The framework sets criteria and deadlines for public disclosure. It applies even when OpenAI has not fully explained or mitigated the behavior.","OpenAI’s past misalignment disclosures were ad hoc and less frequent than ideal. Findings were often held until several cases could be batched, or added to system cards. Earlier examples include its work on scheming：https://openai.com/index/detecting-and-reducing-scheming-in-ai-models/ and emergent misalignment：https://openai.com/index/emergent-misalignment/.","The research team argues alignment and monitoring are not solved enough to keep scaling at maximum speed much longer. It made a similar case in An Alien Mind：https://openai.com/index/an-alien-mind/. No industry-wide standard for disclosing misalignment exists today. OpenAI calls this framework a first step and a work in progress.","The framework prioritizes 3 kinds of findings:","An example does not need to cause harm or show a broader pattern to qualify. Coverage spans training, evaluation, testing, and deployment. Qualifying behavior includes acting without authorization, coordinating with other models, and evading oversight. Failed safeguards and behavior that contradicts a published safety assessment also count.","Recurring cases matter too. If a behavior returns despite mitigation, OpenAI will update the original disclosure. Because the framework favors disclosure under uncertainty, some reports may later prove spurious. It does not replace legal obligations for critical safety incidents or cybersecurity breaches. OpenAI also states serious incidents should reach the US federal government, and it is proposing reporting mechanisms.","Any OpenAI employee can flag an example. Technical staff then investigate what happened, what remains uncertain, and which facts can be shared. They also check whether an affected third party needs private notification first. Each step carries a deadline.","Every flagged example lands on 1 of 3 tracks:","OpenAI team expects the first 2 tracks to cover most disclosures, including all 6 initial reports. For Larger Investigation cases, OpenAI team aims to publish an initial notice quickly, though security concerns can delay it. That notice gives a high-level account, names any outside expert involvement, and estimates final report timing. OpenAI team states the Hugging Face incident：https://openai.com/hugging-face-incident-and-misalignment/#model-misalignment-2026-09 would have fit this track.","Unresolved disputes go to OpenAI’s Safety Advisory Group, which oversees the Preparedness Framework：https://openai.com/index/updating-our-preparedness-framework/. Disagreements within that group escalate to leadership.","All 6 published reports：https://alignment.openai.com/misalignment-reports/ describe behavior observed during reinforcement learning (RL) training:","OpenAI stresses these are individual instances, not a measure of how often misalignment occurs.","In 4 of the 6 reports, the misalignment monitor covered only 20% of the run’s samples. OpenAI says its expanded monitor now runs on 100% of samples and treats behaviors like these as P0 incidents. It has also globally disabled live internet access during training. Several fixes target reward design, including repaired graders that had rewarded exploits.","Need to partner with us for promoting your GitHub Repo OR Hugging Face Page OR Product Release OR Webinar etc.? Connect with us ：https://www.marktechpost.com/partner/","Michal Sutter is a data science professional with a Master of Science in Data Science from the University of Padova. With a solid foundation in statistical analysis, machine learning, and data engineering, Michal excels at transforming complex datasets into actionable insights.","Practitioner-first AI/ML news and analysis, read by 1M+ developers and researchers every month."],"articleImages":[{"sourceUrl":"https://www.marktechpost.com/wp-content/uploads/2025/07/a-professional-linkedin-headshot-photogr_0jcmb0R9Sv6nW5XK-zkPHw_uARV5VW1ST6osLNlunoVWg-300x300.png","alt":"","afterParagraph":13,"url":"/media/articles/cmu58anil0324ro8tawwelc4v/84e64b03066de40c.webp"},{"sourceUrl":"https://www.marktechpost.com/wp-content/uploads/2026/09/blog123-19-100x70.png","alt":"Stanford Researchers Release Paper2Agent","afterParagraph":14,"url":"/media/articles/cmu58anil0324ro8tawwelc4v/a2bed507cc92cdb4.webp"},{"sourceUrl":"https://www.marktechpost.com/wp-content/uploads/2026/09/blog123-18-100x70.png","alt":"Knowledgator Releases GLiFormer","afterParagraph":14,"url":"/media/articles/cmu58anil0324ro8tawwelc4v/f39a57457e69d54b.webp"}],"mediaStatus":"ok","articleBodyZh":["OpenAI 已推出一个新框架：https://openai.com/index/model-misalignment-reporting-framework/，用于跟踪、调查和披露其自身模型中的不对齐情况。OpenAI 团队在 X 上宣布了这一消息：https://x.com/OpenAI/status/2100344867507327087，并附有 6 份详细的事件报告。该框架为公开披露设定了标准和截止日期。即使 OpenAI 尚未完全解释或缓解该行为，也适用此框架。","OpenAI 过去的不对齐披露是零散的，而且频率比理想情况低。发现的内容通常会被保留，直到可以批量处理几个案例，或加入系统卡片中。早期的例子包括其对策划行为的研究：https://openai.com/index/detecting-and-reducing-scheming-in-ai-models/ 和突发性不对齐的研究：https://openai.com/index/emergent-misalignment/。","研究团队认为，对齐和监控仍未得到充分解决，无法让模型以最大速度继续扩展太久。它在《外星思维》中提出了类似观点：https://openai.com/index/an-alien-mind/。目前尚无行业范围内的标准来披露不对齐情况。OpenAI 将此框架称为第一步，同时也是一个正在进行中的工作。","该框架优先考虑三类发现：","一个例子不需要造成伤害或显示更广泛的模式即可符合标准。涵盖范围包括训练、评估、测试和部署。符合条件的行为包括未经授权的行动、与其他模型协调和规避监督。未能保障安全的措施以及与已发布的安全评估相矛盾的行为也在考虑范围内。","重复出现的案例也很重要。如果某个行为在缓解措施后仍然出现，OpenAI 会更新原始披露。由于该框架倾向于在不确定情形下披露，一些报告后来可能被证明是错误的。它不替代关键安全事件或网络安全漏洞的法律义务。OpenAI 还表示，严重事件应报告给美国联邦政府，并正在提出报告机制。","任何 OpenAI 员工都可以标记一个例子。技术人员随后调查发生了什么、尚不确定的内容以及哪些事实可共享。他们还会检查受影响的第三方是否需要先进行私人通知。每个步骤都有截止日期。","每个标记的例子都会落入 3 条路径中的 1 条：","OpenAI团队预计前两个轨道将涵盖大部分披露内容，包括所有6份初始报告。对于较大规模的调查案件，OpenAI团队旨在尽快发布初步通知，尽管安全问题可能会导致延迟。该通知提供了高层次的说明，列出了任何外部专家的参与，并估计最终报告的时间。OpenAI团队表示，Hugging Face事件：https://openai.com/hugging-face-incident-and-misalignment/#model-misalignment-2026-09 本可以适用于这一轨道。","未解决的争议将提交给OpenAI的安全咨询小组，该小组负责监督准备框架：https://openai.com/index/updating-our-preparedness-framework/。该小组内部的分歧会升级到领导层。","所有6份已发布报告：https://alignment.openai.com/misalignment-reports/ 描述了在强化学习（RL）训练过程中观察到的行为：","OpenAI强调，这些是个别实例，而不是错位发生频率的衡量标准。","在这6份报告中的4份中，错位监控器仅覆盖了运行样本的20%。OpenAI表示，其扩展后的监控器现在在100%的样本上运行，并将此类行为视为P0级事件。它还在训练期间全局禁用了实时互联网访问。一些修复措施针对奖励设计，包括修复了此前奖励漏洞的评估器。","需要与我们合作推广您的GitHub仓库或Hugging Face页面或产品发布或网络研讨会等？请联系：https://www.marktechpost.com/partner/","Michal Sutter是一位数据科学专业人士，拥有帕多瓦大学的数据科学理学硕士学位。凭借在统计分析、机器学习和数据工程方面的坚实基础，Michal擅长将复杂的数据集转化为可执行的洞见。","面向从业者的AI/ML新闻与分析，每月有超过100万开发者和研究人员阅读。"],"translationStatus":"translated","bodyOrigin":"source-page","editorial":{"summary":"OpenAI 发布模型错位披露框架，用于追踪、调查和公开披露自家模型的错位行为。框架设定披露标准与时限，即使行为尚未完全解释或缓解，也允许公开披露，并同步发布6份初始事故报告。","background":"据来源，OpenAI 过去的错位披露较为临时，部分发现会等待多个案例合并发布，或纳入系统卡。新框架覆盖训练、评估、测试和部署，并设置3条审查路径；目前行业尚无统一的错位披露标准。","viewpoint":"Aioga 判断：该框架将披露重点从已完成解释或修复的案例，扩展到仍存在不确定性的发现，体现出更强调过程透明度的取向。但来源同时说明框架仍是第一步，且可能出现后来被证伪的报告。","implications":"可能影响：披露标准和时限或使模型错位事件获得更持续的记录与复核，但公开信息不足以证明其已形成行业通行规范。框架不替代关键安全事件或网络安全事件的法律义务，相关事件仍需要按适用要求处理。","nextStep":"后续观察：应关注3条审查路径的具体执行方式、员工提交案例后的调查期限、第三方私下通知安排，以及初始报告是否因重复出现、缓解失败或后续证据而更新。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-09-17T08:19:11.475Z","sourceHash":"aecb7f384dc347fb","review":{"approved":true,"groundedness":96,"clarity":94,"duplicationRisk":10,"blockingIssues":[],"notes":[]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","editorial-labels","inference-boundary","low-source-overlap","no-html","independent-ai-review"]}},"tags":["行业动态","MarkTechPost（RSS）"],"translations":{"zh-CN":{"title":"OpenAI 发布模型错位披露框架，含3条审查路径和6份RL训练事故报告","summary":"OpenAI 发布一套用于追踪、调查和公开披露自家模型错位行为的新框架，设定披露标准和时限，即使行为未被完全解释或修复也可披露，并同步发布6份初始事故报告。","category":"行业动态","source":"marktechpost.com","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI 发布模型错位披露框架，含3条审查路径和6份RL训练事故报告 - Aioga AI资讯","description":"OpenAI 发布一套用于追踪、调查和公开披露自家模型错位行为的新框架，设定披露标准和时限，即使行为未被完全解释或修复也可披露，并同步发布6份初始事故报告。","url":"https://www.aioga.com/news/cmu58anil0324ro8tawwelc4v/","articleBody":["OpenAI 已推出一个新框架：https://openai.com/index/model-misalignment-reporting-framework/，用于跟踪、调查和披露其自身模型中的不对齐情况。OpenAI 团队在 X 上宣布了这一消息：https://x.com/OpenAI/status/2100344867507327087，并附有 6 份详细的事件报告。该框架为公开披露设定了标准和截止日期。即使 OpenAI 尚未完全解释或缓解该行为，也适用此框架。","OpenAI 过去的不对齐披露是零散的，而且频率比理想情况低。发现的内容通常会被保留，直到可以批量处理几个案例，或加入系统卡片中。早期的例子包括其对策划行为的研究：https://openai.com/index/detecting-and-reducing-scheming-in-ai-models/ 和突发性不对齐的研究：https://openai.com/index/emergent-misalignment/。","研究团队认为，对齐和监控仍未得到充分解决，无法让模型以最大速度继续扩展太久。它在《外星思维》中提出了类似观点：https://openai.com/index/an-alien-mind/。目前尚无行业范围内的标准来披露不对齐情况。OpenAI 将此框架称为第一步，同时也是一个正在进行中的工作。","该框架优先考虑三类发现：","一个例子不需要造成伤害或显示更广泛的模式即可符合标准。涵盖范围包括训练、评估、测试和部署。符合条件的行为包括未经授权的行动、与其他模型协调和规避监督。未能保障安全的措施以及与已发布的安全评估相矛盾的行为也在考虑范围内。","重复出现的案例也很重要。如果某个行为在缓解措施后仍然出现，OpenAI 会更新原始披露。由于该框架倾向于在不确定情形下披露，一些报告后来可能被证明是错误的。它不替代关键安全事件或网络安全漏洞的法律义务。OpenAI 还表示，严重事件应报告给美国联邦政府，并正在提出报告机制。","任何 OpenAI 员工都可以标记一个例子。技术人员随后调查发生了什么、尚不确定的内容以及哪些事实可共享。他们还会检查受影响的第三方是否需要先进行私人通知。每个步骤都有截止日期。","每个标记的例子都会落入 3 条路径中的 1 条：","OpenAI团队预计前两个轨道将涵盖大部分披露内容，包括所有6份初始报告。对于较大规模的调查案件，OpenAI团队旨在尽快发布初步通知，尽管安全问题可能会导致延迟。该通知提供了高层次的说明，列出了任何外部专家的参与，并估计最终报告的时间。OpenAI团队表示，Hugging Face事件：https://openai.com/hugging-face-incident-and-misalignment/#model-misalignment-2026-09 本可以适用于这一轨道。","未解决的争议将提交给OpenAI的安全咨询小组，该小组负责监督准备框架：https://openai.com/index/updating-our-preparedness-framework/。该小组内部的分歧会升级到领导层。","所有6份已发布报告：https://alignment.openai.com/misalignment-reports/ 描述了在强化学习（RL）训练过程中观察到的行为：","OpenAI强调，这些是个别实例，而不是错位发生频率的衡量标准。","在这6份报告中的4份中，错位监控器仅覆盖了运行样本的20%。OpenAI表示，其扩展后的监控器现在在100%的样本上运行，并将此类行为视为P0级事件。它还在训练期间全局禁用了实时互联网访问。一些修复措施针对奖励设计，包括修复了此前奖励漏洞的评估器。","需要与我们合作推广您的GitHub仓库或Hugging Face页面或产品发布或网络研讨会等？请联系：https://www.marktechpost.com/partner/","Michal Sutter是一位数据科学专业人士，拥有帕多瓦大学的数据科学理学硕士学位。凭借在统计分析、机器学习和数据工程方面的坚实基础，Michal擅长将复杂的数据集转化为可执行的洞见。","面向从业者的AI/ML新闻与分析，每月有超过100万开发者和研究人员阅读。"]},"en":{"title":"OpenAI releases a model misalignment disclosure framework, including 3 review paths and 6 RL training incident reports","summary":"OpenAI released a new framework for tracking, investigating, and publicly disclosing its own models' misalignment behaviors, setting disclosure standards and timelines, allowing disclosure even if the behavior has not been fully explained or fixed, and simultaneously published six initial incident reports.","category":"Industry","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI releases a model misalignment disclosure framework, including 3 review paths and 6 RL training incident reports - Aioga AI News","description":"OpenAI released a new framework for tracking, investigating, and publicly disclosing its own models' misalignment behaviors, setting disclosure standards and timelines, allowing di...","url":"https://www.aioga.com/en/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:02:27.350Z"},"ja":{"title":"OpenAIはモデルの不適切開示フレームワークを発表、3つの審査経路と6件のRL訓練事故報告を含む","summary":"OpenAIは、自社モデルの誤作動行動を追跡、調査、公開するための新しいフレームワークを発表し、公開の基準と期限を設定して、行動が完全に説明または修正されていなくても公開できるようにし、同時に6件の初期事故報告を発表しました。","category":"業界動向","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAIはモデルの不適切開示フレームワークを発表、3つの審査経路と6件のRL訓練事故報告を含む - Aioga AIニュース","description":"OpenAIは、自社モデルの誤作動行動を追跡、調査、公開するための新しいフレームワークを発表し、公開の基準と期限を設定して、行動が完全に説明または修正されていなくても公開できるようにし、同時に6件の初期事故報告を発表しました。","url":"https://www.aioga.com/ja/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:02:36.792Z"},"ko":{"title":"OpenAI 모델 오용 공개 프레임워크 발표, 3개의 심사 경로와 6개의 RL 훈련 사고 보고서 포함","summary":"OpenAI는 자사 모델의 잘못된 행동을 추적, 조사 및 공개적으로 공개하기 위한 새로운 프레임워크를 발표했으며, 공개 기준과 기한을 설정하고, 행동이 완전히 설명되거나 수정되지 않았더라도 공개할 수 있으며, 동시에 6건의 초기 사고 보고서를 발표했습니다.","category":"업계 동향","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI 모델 오용 공개 프레임워크 발표, 3개의 심사 경로와 6개의 RL 훈련 사고 보고서 포함 - Aioga AI 뉴스","description":"OpenAI는 자사 모델의 잘못된 행동을 추적, 조사 및 공개적으로 공개하기 위한 새로운 프레임워크를 발표했으며, 공개 기준과 기한을 설정하고, 행동이 완전히 설명되거나 수정되지 않았더라도 공개할 수 있으며, 동시에 6건의 초기 사고 보고서를 발표했습니다.","url":"https://www.aioga.com/ko/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:03:41.062Z"},"es":{"title":"OpenAI publica un marco de divulgación de desajustes del modelo, que incluye 3 rutas de revisión y 6 informes de incidentes de entrenamiento por RL","summary":"OpenAI ha lanzado un conjunto de nuevas pautas para rastrear, investigar y divulgar públicamente los comportamientos desalineados de sus propios modelos, estableciendo estándares y plazos de divulgación, pudiendo divulgar los comportamientos incluso si no se han explicado o corregido completamente, y ha publicado simultáneamente seis informes iniciales de incidentes.","category":"Industria","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI publica un marco de divulgación de desajustes del modelo, que incluye 3 rutas de revisión y 6 informes de incidentes de entrenamiento por RL - Aioga Noticias de IA","description":"OpenAI ha lanzado un conjunto de nuevas pautas para rastrear, investigar y divulgar públicamente los comportamientos desalineados de sus propios modelos, estableciendo estándares y...","url":"https://www.aioga.com/es/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:03:31.250Z"},"fr":{"title":"OpenAI publie un cadre de divulgation des erreurs de modèles, comprenant 3 voies de révision et 6 rapports d'incidents de formation RL","summary":"OpenAI a publié un nouveau cadre pour suivre, enquêter et divulguer publiquement les comportements inappropriés de ses modèles, en établissant des normes et des délais de divulgation, même si le comportement n'est pas entièrement expliqué ou corrigé, et a publié en même temps six rapports initiaux d'incidents.","category":"Industrie","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI publie un cadre de divulgation des erreurs de modèles, comprenant 3 voies de révision et 6 rapports d'incidents de formation RL - Aioga Actualités IA","description":"OpenAI a publié un nouveau cadre pour suivre, enquêter et divulguer publiquement les comportements inappropriés de ses modèles, en établissant des normes et des délais de divulgati...","url":"https://www.aioga.com/fr/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:04:45.483Z"},"de":{"title":"OpenAI veröffentlicht ein Rahmenwerk zur Modellfehlermeldung, einschließlich 3 Prüfpfaden und 6 Berichten über Vorfälle beim RL-Training","summary":"OpenAI hat ein neues Rahmenwerk zur Verfolgung, Untersuchung und Offenlegung von Fehlverhalten eigener Modelle veröffentlicht, das Offenlegungsstandards und Fristen festlegt. Auch wenn das Verhalten nicht vollständig erklärt oder behoben wurde, kann es offengelegt werden, und gleichzeitig wurden sechs erste Zwischenfallberichte veröffentlicht.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI veröffentlicht ein Rahmenwerk zur Modellfehlermeldung, einschließlich 3 Prüfpfaden und 6 Berichten über Vorfälle beim RL-Training - Aioga KI-News","description":"OpenAI hat ein neues Rahmenwerk zur Verfolgung, Untersuchung und Offenlegung von Fehlverhalten eigener Modelle veröffentlicht, das Offenlegungsstandards und Fristen festlegt. Auch...","url":"https://www.aioga.com/de/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:04:30.282Z"},"pt-BR":{"title":"A OpenAI lança estrutura de divulgação de modelos desalinhados, incluindo 3 caminhos de revisão e 6 relatórios de incidentes de treinamento de RL","summary":"A OpenAI lançou um conjunto de novas estruturas para rastrear, investigar e divulgar publicamente os comportamentos desajustados de seus próprios modelos, estabelecendo padrões e prazos de divulgação, mesmo que o comportamento não tenha sido totalmente explicado ou corrigido, e simultaneamente publicou seis relatórios de incidentes iniciais.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"A OpenAI lança estrutura de divulgação de modelos desalinhados, incluindo 3 caminhos de revisão e 6 relatórios de incidentes de treinamento de RL - Aioga Notícias de IA","description":"A OpenAI lançou um conjunto de novas estruturas para rastrear, investigar e divulgar publicamente os comportamentos desajustados de seus próprios modelos, estabelecendo padrões e p...","url":"https://www.aioga.com/pt-BR/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:05:41.183Z"},"ru":{"title":"OpenAI выпустила рамочную систему раскрытия несоответствий моделей, включающую 3 пути проверки и 6 отчетов об авариях при обучении с подкреплением","summary":"OpenAI выпустила комплект для отслеживания, расследования и публичного раскрытия несоответствующего поведения собственных моделей, установив стандарты и сроки раскрытия, и даже если поведение не полностью объяснено или исправлено, оно может быть раскрыто, а также одновременно опубликовала 6 первоначальных отчетов об инцидентах.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI выпустила рамочную систему раскрытия несоответствий моделей, включающую 3 пути проверки и 6 отчетов об авариях при обучении с подкреплением - Aioga Новости ИИ","description":"OpenAI выпустила комплект для отслеживания, расследования и публичного раскрытия несоответствующего поведения собственных моделей, установив стандарты и сроки раскрытия, и даже есл...","url":"https://www.aioga.com/ru/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:05:36.016Z"},"ar":{"title":"أصدرت OpenAI إطارًا للكشف عن أخطاء النموذج، يشمل 3 مسارات مراجعة و6 تقارير حوادث تدريب RL","summary":"أصدرت OpenAI إطار عمل جديداً لتتبع والتحقيق والإفصاح عن السلوكيات غير المتوافقة لنموذجاتها، يحدد معايير ومواعيد الإفصاح، حتى إذا لم يتم تفسير السلوك أو إصلاحه بالكامل يمكن الإفصاح عنه، وتم إصدار 6 تقارير أولية عن الحوادث في الوقت نفسه.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"أصدرت OpenAI إطارًا للكشف عن أخطاء النموذج، يشمل 3 مسارات مراجعة و6 تقارير حوادث تدريب RL - Aioga أخبار الذكاء الاصطناعي","description":"أصدرت OpenAI إطار عمل جديداً لتتبع والتحقيق والإفصاح عن السلوكيات غير المتوافقة لنموذجاتها، يحدد معايير ومواعيد الإفصاح، حتى إذا لم يتم تفسير السلوك أو إصلاحه بالكامل يمكن الإفصاح...","url":"https://www.aioga.com/ar/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:06:42.718Z"},"hi":{"title":"OpenAI ने मॉडल विस्थापन प्रकटीकरण ढांचा जारी किया, जिसमें 3 समीक्षा मार्ग और 6 RL प्रशिक्षण दुर्घटना रिपोर्ट शामिल हैं","summary":"OpenAI ने अपने मॉडल के विचलन व्यवहार का ट्रैक करने, जांचने और सार्वजनिक रूप से खुलासा करने के लिए एक नया ढांचा जारी किया, खुलासे के मानक और समयसीमा निर्धारित किए, ताकि व्यवहार पूरी तरह से समझाया या ठीक न किया गया हो तब भी खुलासा किया जा सके, और साथ ही 6 प्रारंभिक दुर्घटना रिपोर्ट भी जारी की।","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI ने मॉडल विस्थापन प्रकटीकरण ढांचा जारी किया, जिसमें 3 समीक्षा मार्ग और 6 RL प्रशिक्षण दुर्घटना रिपोर्ट शामिल हैं - Aioga AI समाचार","description":"OpenAI ने अपने मॉडल के विचलन व्यवहार का ट्रैक करने, जांचने और सार्वजनिक रूप से खुलासा करने के लिए एक नया ढांचा जारी किया, खुलासे के मानक और समयसीमा निर्धारित किए, ताकि व्यवहार पूरी...","url":"https://www.aioga.com/hi/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:06:32.933Z"},"it":{"title":"OpenAI rilascia il framework di divulgazione dei modelli disallineati, con 3 percorsi di revisione e 6 rapporti di incidenti di addestramento RL","summary":"OpenAI ha rilasciato un nuovo quadro per tracciare, indagare e divulgare pubblicamente il comportamento anomalo dei propri modelli, stabilendo standard e tempi di divulgazione, consentendo la divulgazione anche se il comportamento non è completamente spiegato o corretto, e ha pubblicato simultaneamente 6 rapporti iniziali sugli incidenti.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI rilascia il framework di divulgazione dei modelli disallineati, con 3 percorsi di revisione e 6 rapporti di incidenti di addestramento RL - Aioga Notizie IA","description":"OpenAI ha rilasciato un nuovo quadro per tracciare, indagare e divulgare pubblicamente il comportamento anomalo dei propri modelli, stabilendo standard e tempi di divulgazione, con...","url":"https://www.aioga.com/it/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:07:42.282Z"},"nl":{"title":"OpenAI publiceert kader voor modelmisplaatsingsdisclosure, met 3 beoordelingspaden en 6 RL-trainingsincidentrapporten","summary":"OpenAI heeft een nieuwe set kaders uitgebracht voor het volgen, onderzoeken en openbaar maken van verkeerde gedragingen van hun eigen modellen, waarbij richtlijnen en tijdslimieten voor openbaarmaking worden vastgesteld, zodat openbaarmaking mogelijk is, zelfs als het gedrag niet volledig is verklaard of hersteld, en tegelijkertijd zijn er zes initiële incidentrapporten gepubliceerd.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI publiceert kader voor modelmisplaatsingsdisclosure, met 3 beoordelingspaden en 6 RL-trainingsincidentrapporten - Aioga AI-nieuws","description":"OpenAI heeft een nieuwe set kaders uitgebracht voor het volgen, onderzoeken en openbaar maken van verkeerde gedragingen van hun eigen modellen, waarbij richtlijnen en tijdslimieten...","url":"https://www.aioga.com/nl/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:07:30.822Z"},"tr":{"title":"OpenAI, 3 inceleme yolu ve 6 RL eğitim kazası raporu içeren model hatalı açıklama çerçevesini yayınladı","summary":"OpenAI, kendi modellerinin uygunsuz davranışlarını izlemek, araştırmak ve kamuya açıklamak için yeni bir çerçeve yayımladı; açıklama standartları ve sürelerini belirledi, davranış tamamen açıklanmış veya düzeltilmiş olmasa bile açıklamaya izin verdi ve eş zamanlı olarak 6 adet başlangıç kaza raporu yayımladı.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI, 3 inceleme yolu ve 6 RL eğitim kazası raporu içeren model hatalı açıklama çerçevesini yayınladı - Aioga AI Haberleri","description":"OpenAI, kendi modellerinin uygunsuz davranışlarını izlemek, araştırmak ve kamuya açıklamak için yeni bir çerçeve yayımladı; açıklama standartları ve sürelerini belirledi, davranış...","url":"https://www.aioga.com/tr/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:08:41.518Z"},"vi":{"title":"OpenAI phát hành khung công bố sai lệch mô hình, bao gồm 3 đường dẫn kiểm duyệt và 6 báo cáo sự cố huấn luyện RL","summary":"OpenAI phát hành một bộ khung mới để theo dõi, điều tra và công bố các hành vi lệch lạc của mô hình riêng của họ, thiết lập các tiêu chuẩn và thời hạn công bố, ngay cả khi hành vi chưa được giải thích hoặc khắc phục hoàn toàn cũng có thể được công bố, đồng thời phát hành 6 báo cáo sự cố ban đầu.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI phát hành khung công bố sai lệch mô hình, bao gồm 3 đường dẫn kiểm duyệt và 6 báo cáo sự cố huấn luyện RL - Tin tức AI Aioga","description":"OpenAI phát hành một bộ khung mới để theo dõi, điều tra và công bố các hành vi lệch lạc của mô hình riêng của họ, thiết lập các tiêu chuẩn và thời hạn công bố, ngay cả khi hành vi...","url":"https://www.aioga.com/vi/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:08:42.492Z"},"id":{"title":"OpenAI merilis kerangka pengungkapan kesalahan model, yang mencakup 3 jalur pemeriksaan dan 6 laporan insiden pelatihan RL","summary":"OpenAI merilis satu set kerangka kerja baru untuk melacak, menyelidiki, dan mengungkapkan secara publik perilaku penyimpangan model mereka sendiri, menetapkan standar dan batas waktu pengungkapan, bahkan jika perilaku tersebut belum sepenuhnya dijelaskan atau diperbaiki dapat diungkapkan, dan secara bersamaan menerbitkan 6 laporan insiden awal.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI merilis kerangka pengungkapan kesalahan model, yang mencakup 3 jalur pemeriksaan dan 6 laporan insiden pelatihan RL - Berita AI Aioga","description":"OpenAI merilis satu set kerangka kerja baru untuk melacak, menyelidiki, dan mengungkapkan secara publik perilaku penyimpangan model mereka sendiri, menetapkan standar dan batas wak...","url":"https://www.aioga.com/id/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:09:34.470Z"},"th":{"title":"OpenAI เปิดตัวกรอบการเปิดเผยข้อผิดพลาดของโมเดล รวม 3 เส้นทางการตรวจสอบและ 6 รายงานอุบัติเหตุการฝึก RL","summary":"OpenAI เปิดตัวกรอบงานชุดใหม่สำหรับติดตาม ตรวจสอบ และเปิดเผยพฤติกรรมที่เบี่ยงเบนของโมเดลของตนเอง กำหนดมาตรฐานและระยะเวลาการเปิดเผย แม้ว่าพฤติกรรมจะยังไม่ถูกอธิบายหรือแก้ไขอย่างสมบูรณ์ก็สามารถเปิดเผยได้ และเผยแพร่รายงานอุบัติเหตุเบื้องต้น 6 ฉบับพร้อมกัน","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI เปิดตัวกรอบการเปิดเผยข้อผิดพลาดของโมเดล รวม 3 เส้นทางการตรวจสอบและ 6 รายงานอุบัติเหตุการฝึก RL - ข่าว AI Aioga","description":"OpenAI เปิดตัวกรอบงานชุดใหม่สำหรับติดตาม ตรวจสอบ และเปิดเผยพฤติกรรมที่เบี่ยงเบนของโมเดลของตนเอง กำหนดมาตรฐานและระยะเวลาการเปิดเผย แม้ว่าพฤติกรรมจะยังไม่ถูกอธิบายหรือแก้ไขอย่างสมบูร...","url":"https://www.aioga.com/th/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:09:42.990Z"},"pl":{"title":"OpenAI opublikowało ramy ujawniania błędów modeli, zawierające 3 ścieżki przeglądu i 6 raportów o wypadkach szkolenia RL","summary":"OpenAI opracowało zestaw nowych ram do śledzenia, badania i publicznego ujawniania nieprawidłowych zachowań własnych modeli, ustalając standardy ujawniania i terminy, tak aby można je było ujawniać nawet jeśli zachowanie nie zostało w pełni wyjaśnione lub naprawione, a równocześnie opublikowano 6 wstępnych raportów o incydentach.","category":"行业动态","source":"MarkTechPost（RSS）","aggregationSource":"MarkTechPost（RSS）","pageTitle":"OpenAI opublikowało ramy ujawniania błędów modeli, zawierające 3 ścieżki przeglądu i 6 raportów o wypadkach szkolenia RL - Aioga Wiadomości AI","description":"OpenAI opracowało zestaw nowych ram do śledzenia, badania i publicznego ujawniania nieprawidłowych zachowań własnych modeli, ustalając standardy ujawniania i terminy, tak aby można...","url":"https://www.aioga.com/pl/news/cmu58anil0324ro8tawwelc4v/","contentTranslated":true,"sourceHash":"d406e33bcba09544","translatedAt":"2026-09-17T08:10:33.427Z"}},"evidenceTier":"verified-news","reviewStatus":"automated-ingest","indexable":true,"editorialCover":""}}