{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-09-28T06:03:00.468Z","headline":"OpenAI 长文阐述对齐与监测困境，称 CoT 监控能力正在减弱","description":"OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。","url":"https://www.aioga.com/news/cmtq23v6k01aorotwh8xip8r1/","mainEntityOfPage":"https://www.aioga.com/news/cmtq23v6k01aorotwh8xip8r1/","datePublished":"2026-09-06T09:00:00.000Z","dateModified":"2026-09-06T09:00:00.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://openai.com/index/an-alien-mind","https://aihot.news/items/cmtq23v6k01aorotwh8xip8r1"],"canonicalUrl":"https://www.aioga.com/news/cmtq23v6k01aorotwh8xip8r1/","directAnswer":{"@type":"Answer","text":"OpenAI 发布长文《An Alien Mind》，回顾 2023 年 RLSlow 项目与推理模型可扩展训练的起点，并讨论目标对齐、价值对齐及链式思维监控效果变化。","url":"https://www.aioga.com/news/cmtq23v6k01aorotwh8xip8r1/","dateCreated":"2026-09-06T09:00:00.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"OpenAI source article","url":"https://openai.com/index/an-alien-mind","datePublished":"2026-09-06T09:00:00.000Z","provider":{"@type":"Organization","name":"OpenAI","url":"https://openai.com/index/an-alien-mind"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.news/items/cmtq23v6k01aorotwh8xip8r1","datePublished":"2026-09-06T09:00:00.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.news/items/cmtq23v6k01aorotwh8xip8r1"}}],"aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","originalPublisher":{"name":"OpenAI","url":"https://openai.com/index/an-alien-mind"},"geoDeepAnswer":null,"article":{"id":"cmtq23v6k01aorotwh8xip8r1","slug":"cmtq23v6k01aorotwh8xip8r1","url":"https://www.aioga.com/news/cmtq23v6k01aorotwh8xip8r1/","title":"OpenAI 长文阐述对齐与监测困境，称 CoT 监控能力正在减弱","title_en":"","summary":"OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","sourceUrl":"https://openai.com/index/an-alien-mind","aiHotUrl":"https://aihot.news/items/cmtq23v6k01aorotwh8xip8r1","publishedAt":"2026-09-06T09:00:00.000Z","category":"行业动态","score":72,"selected":true,"articleBody":["OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。","文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；","作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。"],"articleImages":[],"mediaStatus":"none","articleBodyZh":["OpenAI 长文阐述对齐与监测困境，称 CoT 监控能力正在减弱 这条更新来自 openai.com，发布时间为 2026-09-06，Aioga 保留原文入口以便核验。","摘要：OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。","背景：文章将目标对齐与价值对齐区分开来，并指出链式思维监控效果会随着模型能力提升而逐步减弱。摘要还提到 GPT-6 Astra 与 GPT-5.6 Sol 的对齐表现差异。","Aioga 观察：Aioga 判断：这篇文章的核心不只是讨论模型是否对齐，也在于提示现有监测方式可能存在能力边界。关于递归自我改进的表述仍属于作者预期，不能视为已经发生的事实。","影响与后续：可能影响：若链式思维监控效果确实持续减弱，现有对齐评估的充分性可能需要重新审视；建立第三方安全门槛和加强国际协调的建议，不代表相关机制已经形成。 后续观察：应继续关注 OpenAI 是否披露更具体的监测证据、第三方安全门槛设计及国际协调进展，也需要区分作者对 RSI 的预期与已被来源确认的模型行为。"],"translationStatus":"","bodyOrigin":"summary-fallback","editorial":{"summary":"OpenAI 发布长文《An Alien Mind》，回顾 2023 年 RLSlow 项目与推理模型可扩展训练的起点，并讨论目标对齐、价值对齐及链式思维监控效果变化。","background":"文章将目标对齐与价值对齐区分开来，并指出链式思维监控效果会随着模型能力提升而逐步减弱。摘要还提到 GPT-6 Astra 与 GPT-5.6 Sol 的对齐表现差异。","viewpoint":"Aioga 判断：这篇文章的核心不只是讨论模型是否对齐，也在于提示现有监测方式可能存在能力边界。关于递归自我改进的表述仍属于作者预期，不能视为已经发生的事实。","implications":"可能影响：若链式思维监控效果确实持续减弱，现有对齐评估的充分性可能需要重新审视；建立第三方安全门槛和加强国际协调的建议，不代表相关机制已经形成。","nextStep":"后续观察：应继续关注 OpenAI 是否披露更具体的监测证据、第三方安全门槛设计及国际协调进展，也需要区分作者对 RSI 的预期与已被来源确认的模型行为。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-09-06T17:25:12.246Z","sourceHash":"df4f3a81b246191d","review":{"approved":true,"groundedness":94,"clarity":92,"duplicationRisk":25,"blockingIssues":[],"notes":[]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","editorial-labels","inference-boundary","low-source-overlap","no-html","independent-ai-review"]}},"tags":["行业动态","OpenAI：官网动态（RSS · 排除企业/客户案例）"],"translations":{"zh-CN":{"title":"OpenAI 长文阐述对齐与监测困境，称 CoT 监控能力正在减弱","summary":"OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。","category":"行业动态","source":"OpenAI","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI 长文阐述对齐与监测困境，称 CoT 监控能力正在减弱 - Aioga AI资讯","description":"OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三...","url":"https://www.aioga.com/news/cmtq23v6k01aorotwh8xip8r1/","articleBody":["OpenAI 长文阐述对齐与监测困境，称 CoT 监控能力正在减弱 这条更新来自 openai.com，发布时间为 2026-09-06，Aioga 保留原文入口以便核验。","摘要：OpenAI 发布长文《An Alien Mind》，回溯 2023 年 RLSlow 项目中确认推理模型可扩展训练的起点，并系统阐述目标对齐与价值对齐的区分。文章指出链式思维监控的效果正随着模型能力提升而逐步减弱，GPT-6 Astra 在对齐上显著优于 GPT-5.6 Sol；作者预期进展可能持续走向机器递归自我改进（RSI），呼吁自愿放缓扩展、建立第三方安全门槛并加强国际协调。","背景：文章将目标对齐与价值对齐区分开来，并指出链式思维监控效果会随着模型能力提升而逐步减弱。摘要还提到 GPT-6 Astra 与 GPT-5.6 Sol 的对齐表现差异。","Aioga 观察：Aioga 判断：这篇文章的核心不只是讨论模型是否对齐，也在于提示现有监测方式可能存在能力边界。关于递归自我改进的表述仍属于作者预期，不能视为已经发生的事实。","影响与后续：可能影响：若链式思维监控效果确实持续减弱，现有对齐评估的充分性可能需要重新审视；建立第三方安全门槛和加强国际协调的建议，不代表相关机制已经形成。 后续观察：应继续关注 OpenAI 是否披露更具体的监测证据、第三方安全门槛设计及国际协调进展，也需要区分作者对 RSI 的预期与已被来源确认的模型行为。"]},"en":{"title":"OpenAI wrote a lengthy article outlining the alignment and monitoring dilemma, stating that CoT's monitoring capabilities are weakening","summary":"OpenAI published a lengthy article titled \"An Alien Mind,\" revisiting the 2023 RLSlow project to confirm the starting point of scalable inference model training and systematically explaining the distinction between goal alignment and value alignment. The article points out that the effectiveness of chain-based thinking monitoring is gradually diminishing as model capabilities improve, with GPT-6 Astra significantly outperforming GPT-5.6 Sol in alignment; The author expects progress may continue toward Machine Recursive Self-Improvement (RSI), calling for voluntary slowing of scaling, establishing third-party safety thresholds, and strengthening international coordination.","category":"Industry","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI wrote a lengthy article outlining the alignment and monitoring dilemma, stating that CoT's monitoring capabilities are weakening - Aioga AI News","description":"OpenAI published a lengthy article titled \"An Alien Mind,\" revisiting the 2023 RLSlow project to confirm the starting point of scalable inference model training and systematically...","url":"https://www.aioga.com/en/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:20:44.172Z"},"ja":{"title":"OpenAIは、CoTの監視能力が弱まっていると述べたアライメントと監視のジレンマを詳述した長文記事を書きました","summary":"OpenAIは「An Alien Mind」と題した長文記事を発表し、2023年のRLSlowプロジェクトを再検証し、スケーラブル推論モデルトレーニングの出発点を確認し、目標アライメントと価値アライメントの違いを体系的に説明しています。記事は、チェーンベースの思考モニタリングの効果がモデル能力の向上に伴い徐々に低下しており、GPT-6 AstraはアライメントにおいてGPT-5.6 Solを大きく上回っていることを指摘しています。著者は、スケーリングの自主的な遅延、第三者の安全閾値の設定、国際的な調整強化を求める、機械再帰的自己改善(RSI)への進展が続くと期待しています。","category":"業界動向","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAIは、CoTの監視能力が弱まっていると述べたアライメントと監視のジレンマを詳述した長文記事を書きました - Aioga AIニュース","description":"OpenAIは「An Alien Mind」と題した長文記事を発表し、2023年のRLSlowプロジェクトを再検証し、スケーラブル推論モデルトレーニングの出発点を確認し、目標アライメントと価値アライメントの違いを体系的に説明しています。記事は、チェーンベースの思考モニタリングの効果がモデル能力の向上に伴い徐々に低下しており、GPT-6 Astraはアライメン...","url":"https://www.aioga.com/ja/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:20:44.289Z"},"ko":{"title":"OpenAI 장문에서 정렬 및 모니터링 난관 설명, CoT 모니터링 능력 약화 지적","summary":"OpenAI는 장문 'An Alien Mind'를 발표하며, 2023년 RLSlow 프로젝트에서 추론 모델의 확장 학습 가능성을 확인한 출발점을 회고하고, 목표 정렬과 가치 정렬의 차이를 체계적으로 설명했다. 글에서는 체인 오브 사고(Chain of Thought) 모니터링 효과가 모델 성능 향상과 함께 점차 약화되고 있다고 지적하며, GPT-6 Astra가 GPT-5.6 Sol보다 정렬에서 현저히 우수하다고 언급했다; 저자는 향후 발전이 기계의 재귀적 자기 개선(RSI)로 이어질 가능성을 예상하며, 확장 속도를 자발적으로 늦추고, 제3자 안전 기준을 마련하며, 국제 협력을 강화할 것을 촉구했다.","category":"업계 동향","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI 장문에서 정렬 및 모니터링 난관 설명, CoT 모니터링 능력 약화 지적 - Aioga AI 뉴스","description":"OpenAI는 장문 'An Alien Mind'를 발표하며, 2023년 RLSlow 프로젝트에서 추론 모델의 확장 학습 가능성을 확인한 출발점을 회고하고, 목표 정렬과 가치 정렬의 차이를 체계적으로 설명했다. 글에서는 체인 오브 사고(Chain of Thought) 모니터링 효과가 모델 성능 향상과 함께 점차 약화되고 있...","url":"https://www.aioga.com/ko/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:20:50.268Z"},"es":{"title":"OpenAI expone extensamente los desafíos de alineación y monitoreo, afirma que la capacidad de supervisión CoT está disminuyendo","summary":"OpenAI publicó un artículo largo titulado \"An Alien Mind\", que retrocede al inicio de 2023 del proyecto RLSlow donde se confirmó que los modelos de razonamiento pueden entrenarse de manera escalable, y explica sistemáticamente la distinción entre alineación de objetivos y alineación de valores. El artículo señala que la efectividad de la supervisión de pensamiento en cadena está disminuyendo progresivamente a medida que aumenta la capacidad del modelo. GPT-6 Astra es significativamente superior a GPT-5.6 Sol en cuanto a alineación; el autor prevé que el progreso podría continuar hacia la mejora recursiva automática de máquinas (RSI), y llama a desacelerar voluntariamente la expansión, establecer umbrales de seguridad de terceros y fortalecer la coordinación internacional.","category":"Industria","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI expone extensamente los desafíos de alineación y monitoreo, afirma que la capacidad de supervisión CoT está disminuyendo - Aioga Noticias de IA","description":"OpenAI publicó un artículo largo titulado \"An Alien Mind\", que retrocede al inicio de 2023 del proyecto RLSlow donde se confirmó que los modelos de razonamiento pueden entrenarse d...","url":"https://www.aioga.com/es/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:20:50.417Z"},"fr":{"title":"OpenAI expose longuement les difficultés d'alignement et de supervision, affirmant que la capacité de surveillance CoT est en train de diminuer","summary":"OpenAI publie un long article intitulé « An Alien Mind », retraçant le point de départ de l'entraînement évolutif des modèles de raisonnement confirmé dans le projet RLSlow de 2023, et explique systématiquement la distinction entre alignement des objectifs et alignement des valeurs. L'article indique que l'efficacité de la surveillance par raisonnement en chaîne diminue progressivement avec l'amélioration des capacités des modèles. GPT-6 Astra surpasse nettement GPT-5.6 Sol en termes d'alignement ; l'auteur prévoit que les progrès pourraient continuer vers l'amélioration récursive autonome des machines (RSI), et appelle à ralentir volontairement l'expansion, établir des seuils de sécurité tiers et renforcer la coordination internationale.","category":"Industrie","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI expose longuement les difficultés d'alignement et de supervision, affirmant que la capacité de surveillance CoT est en train de diminuer - Aioga Actualités IA","description":"OpenAI publie un long article intitulé « An Alien Mind », retraçant le point de départ de l'entraînement évolutif des modèles de raisonnement confirmé dans le projet RLSlow de 2023...","url":"https://www.aioga.com/fr/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:20:57.335Z"},"de":{"title":"OpenAI erläutert ausführlich die Herausforderungen von Alignment und Monitoring und stellt fest, dass die CoT-Überwachungsfähigkeiten abnehmen","summary":"OpenAI veröffentlicht einen langen Artikel „An Alien Mind“, der den Ausgangspunkt der skalierbaren Modelltrainingsbestätigung im RLSlow-Projekt 2023 zurückverfolgt und systematisch die Unterscheidung zwischen Zielausrichtung und Wertausrichtung darlegt. Der Artikel stellt fest, dass die Wirksamkeit der Ketten-Denküberwachung mit zunehmender Modellkapazität allmählich abnimmt. GPT-6 Astra ist in der Ausrichtung deutlich überlegen gegenüber GPT-5.6 Sol; die Autoren erwarten, dass der Fortschritt möglicherweise in Richtung maschineller rekursiver Selbstverbesserung (RSI) weitergeht, und rufen dazu auf, die Expansion freiwillig zu verlangsamen, Sicherheitsbarrieren durch Dritte einzurichten und die internationale Koordination zu verstärken.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI erläutert ausführlich die Herausforderungen von Alignment und Monitoring und stellt fest, dass die CoT-Überwachungsfähigkeiten abnehmen - Aioga KI-News","description":"OpenAI veröffentlicht einen langen Artikel „An Alien Mind“, der den Ausgangspunkt der skalierbaren Modelltrainingsbestätigung im RLSlow-Projekt 2023 zurückverfolgt und systematisch...","url":"https://www.aioga.com/de/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:20:57.910Z"},"pt-BR":{"title":"OpenAI discute longamente sobre alinhamento e dilemas de monitoramento, afirmando que a capacidade de monitoramento CoT está enfraquecendo","summary":"OpenAI publicou um artigo longo chamado «An Alien Mind», que revisita o ponto de partida do treinamento escalável de modelos de raciocínio no projeto RLSlow de 2023, e expõe sistematicamente a distinção entre alinhamento de objetivos e alinhamento de valores. O artigo aponta que a eficácia do monitoramento por cadeia de pensamento está gradualmente diminuindo à medida que a capacidade do modelo aumenta; o GPT-6 Astra é significativamente melhor alinhado que o GPT-5.6 Sol. O autor prevê que o progresso pode continuar rumo à melhoria recursiva autônoma da máquina (RSI), e convoca uma desaceleração voluntária da expansão, a criação de barreiras de segurança de terceiros e um fortalecimento da coordenação internacional.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI discute longamente sobre alinhamento e dilemas de monitoramento, afirmando que a capacidade de monitoramento CoT está enfraquecendo - Aioga Notícias de IA","description":"OpenAI publicou um artigo longo chamado «An Alien Mind», que revisita o ponto de partida do treinamento escalável de modelos de raciocínio no projeto RLSlow de 2023, e expõe sistem...","url":"https://www.aioga.com/pt-BR/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:03.252Z"},"ru":{"title":"OpenAI подробно объясняет трудности с выравниванием и мониторингом, заявляя, что способность к контролю цепочки рассуждений (CoT) ослабевает","summary":"OpenAI опубликовала подробную статью «An Alien Mind», в которой возвращается к началу 2023 года, когда в проекте RLSlow было подтверждено, что модели рассуждений масштабируемо обучаемы, и систематически объясняет различие между целевым выравниванием и ценностным выравниванием. В статье отмечается, что эффект мониторинга цепочки рассуждений постепенно снижается по мере повышения мощности моделей; GPT-6 Astra заметно превосходит GPT-5.6 Sol в выравнивании; авторы прогнозируют, что прогресс может продолжить путь к рекурсивному самосовершенствованию машин (RSI), призывая добровольно замедлить масштабирование, установить сторонние безопасные барьеры и укрепить международную координацию.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI подробно объясняет трудности с выравниванием и мониторингом, заявляя, что способность к контролю цепочки рассуждений (CoT) ослабевает - Aioga Новости ИИ","description":"OpenAI опубликовала подробную статью «An Alien Mind», в которой возвращается к началу 2023 года, когда в проекте RLSlow было подтверждено, что модели рассуждений масштабируемо обуч...","url":"https://www.aioga.com/ru/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:03.947Z"},"ar":{"title":"OpenAI توضح بالتفصيل صعوبة المحاذاة والمراقبة، وتقول إن قدرة مراقبة التفكير المتسلسل (CoT) تتراجع","summary":"نشرت OpenAI مقالًا طويلًا بعنوان \"An Alien Mind\"، يستعرض بدايات نموذج RLSlow لعام 2023 في تأكيد إمكانية تدريب نماذج الاستدلال بشكل قابل للتوسع، ويشرح بشكل منظم الفارق بين محاذاة الأهداف ومحاذاة القيم. وأشار المقال إلى أن فعالية مراقبة التفكير المتسلسل تتراجع تدريجيًا مع زيادة قدرة النموذج، وأن GPT-6 Astra تفوق بشكل ملحوظ على GPT-5.6 Sol في المحاذاة؛ ويتوقع الكاتب أن التقدم قد يستمر نحو التحسين الذاتي التكراري للآلة (RSI)، داعيًا إلى التوقف الطوعي عن التوسع، وإنشاء حد أمان من طرف ثالث، وتعزيز التنسيق الدولي.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI توضح بالتفصيل صعوبة المحاذاة والمراقبة، وتقول إن قدرة مراقبة التفكير المتسلسل (CoT) تتراجع - Aioga أخبار الذكاء الاصطناعي","description":"نشرت OpenAI مقالًا طويلًا بعنوان \"An Alien Mind\"، يستعرض بدايات نموذج RLSlow لعام 2023 في تأكيد إمكانية تدريب نماذج الاستدلال بشكل قابل للتوسع، ويشرح بشكل منظم الفارق بين محاذاة ال...","url":"https://www.aioga.com/ar/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:11.435Z"},"hi":{"title":"OpenAI ने लंबे लेख में संरेखण और निगरानी की दुविधा की व्याख्या की, कहा कि CoT निगरानी क्षमता कमजोर हो रही है","summary":"OpenAI ने लंबा लेख \"An Alien Mind\" प्रकाशित किया, जिसमें 2023 के RLSlow प्रोजेक्ट में पुष्टि की गई कि तर्क मॉडल का प्रशिक्षण विस्तारित किया जा सकता है, और लक्ष्य संरेखण और मूल्य संरेखण के बीच अंतर को व्यवस्थित रूप से समझाया। लेख में कहा गया है कि श्रृंखलाबद्ध सोच की निगरानी की प्रभावशीलता मॉडल की क्षमता बढ़ने के साथ धीरे-धीरे कमजोर हो रही है, GPT-6 Astra संरेखण में GPT-5.6 Sol से काफी बेहतर है; लेखक को उम्मीद है कि प्रगति मशीन द्वारा प्रत्यावर्ती आत्म-सुधार (RSI) की ओर जारी रह सकती है, और उन्होंने विस्तार को स्वेच्छा से धीमा करने, तृतीय-पक्ष सुरक्षा मानक स्थापित करने और अंतरराष्ट्रीय समन्वय को मजबूत करने का आह्वान किया।","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI ने लंबे लेख में संरेखण और निगरानी की दुविधा की व्याख्या की, कहा कि CoT निगरानी क्षमता कमजोर हो रही है - Aioga AI समाचार","description":"OpenAI ने लंबा लेख \"An Alien Mind\" प्रकाशित किया, जिसमें 2023 के RLSlow प्रोजेक्ट में पुष्टि की गई कि तर्क मॉडल का प्रशिक्षण विस्तारित किया जा सकता है, और लक्ष्य संरेखण और मूल्य सं...","url":"https://www.aioga.com/hi/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:10.152Z"},"it":{"title":"OpenAI ha scritto un lungo articolo in cui illustra il dilemma di allineamento e monitoraggio, affermando che le capacità di monitoraggio di CoT si stanno indebolendo","summary":"OpenAI ha pubblicato un lungo articolo intitolato \"An Alien Mind\", rivisitando il progetto RLSlow 2023 per confermare il punto di partenza dell'addestramento scalabile del modello di inferenza e spiegare sistematicamente la distinzione tra allineamento degli obiettivi e allineamento dei valori. L'articolo sottolinea che l'efficacia del monitoraggio del pensiero basato su catene sta gradualmente diminuendo man mano che le capacità del modello migliorano, con GPT-6 Astra che supera significativamente GPT-5.6 Sol nell'allineamento; L'autore prevede che i progressi possano continuare verso il Miglioramento Auto-Ricorsivo Macchina (RSI), chiedendo un rallentamento volontario della scala, l'istituzione di soglie di sicurezza di terze parti e il rafforzamento del coordinamento internazionale.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI ha scritto un lungo articolo in cui illustra il dilemma di allineamento e monitoraggio, affermando che le capacità di monitoraggio di CoT si stanno indebolendo - Aioga Notizie IA","description":"OpenAI ha pubblicato un lungo articolo intitolato \"An Alien Mind\", rivisitando il progetto RLSlow 2023 per confermare il punto di partenza dell'addestramento scalabile del modello...","url":"https://www.aioga.com/it/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:20.576Z"},"nl":{"title":"OpenAI beschrijft uitgebreid de uitdagingen van afstemming en monitoring, en stelt dat de CoT-monitoringcapaciteit afneemt","summary":"OpenAI heeft een lang artikel 'An Alien Mind' gepubliceerd, waarin het terugblikt op het punt van start voor schaalbare training van redeneermodellen in het RLSlow-project van 2023, en systematisch het verschil tussen doelafstemming en waardeafstemming uiteenzet. Het artikel stelt dat de effectiviteit van chain-of-thought-monitoring geleidelijk afneemt naarmate modellen krachtiger worden, en dat GPT-6 Astra duidelijk beter is afgestemd dan GPT-5.6 Sol; de auteur verwacht dat vooruitgang mogelijk zal leiden tot recursieve zelfverbetering van machines (RSI), en roept op tot vrijwillige vertraging van uitbreiding, het instellen van drempels voor derden en versterking van internationale coördinatie.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI beschrijft uitgebreid de uitdagingen van afstemming en monitoring, en stelt dat de CoT-monitoringcapaciteit afneemt - Aioga AI-nieuws","description":"OpenAI heeft een lang artikel 'An Alien Mind' gepubliceerd, waarin het terugblikt op het punt van start voor schaalbare training van redeneermodellen in het RLSlow-project van 2023...","url":"https://www.aioga.com/nl/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:18.210Z"},"tr":{"title":"OpenAI, hizalama ve izleme zorluklarını detaylı şekilde anlatan uzun yazı yayımladı, CoT izleme yeteneğinin azalmakta olduğunu belirtti","summary":"OpenAI, \"An Alien Mind\" başlıklı uzun yazıyı yayımladı; 2023 yılında RLSlow projesinde akıl yürütme modellerinin ölçeklenebilir eğitim başlangıcını geri dönük olarak ele aldı ve hedef hizalama ile değer hizalamasını sistematik şekilde açıkladı. Yazıda, model kapasitesi arttıkça zincirleme düşünce izleme etkisinin giderek azaldığı, GPT-6 Astra'nın hizalanmada GPT-5.6 Sol'dan belirgin şekilde üstün olduğu belirtildi; yazar, ilerlemenin makine geri dönüşümlü öz geliştirmeye (RSI) doğru devam edebileceğini öngörüyor, genişlemeyi gönüllü olarak yavaşlatma, üçüncü taraf güvenlik bariyerleri kurma ve uluslararası koordinasyonu güçlendirme çağrısında bulunuyor.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI, hizalama ve izleme zorluklarını detaylı şekilde anlatan uzun yazı yayımladı, CoT izleme yeteneğinin azalmakta olduğunu belirtti - Aioga AI Haberleri","description":"OpenAI, \"An Alien Mind\" başlıklı uzun yazıyı yayımladı; 2023 yılında RLSlow projesinde akıl yürütme modellerinin ölçeklenebilir eğitim başlangıcını geri dönük olarak ele aldı ve he...","url":"https://www.aioga.com/tr/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:28.000Z"},"vi":{"title":"OpenAI trình bày dài về thách thức trong việc đối chiếu và giám sát, cho biết năng lực giám sát CoT đang giảm sút","summary":"OpenAI phát hành bài dài “An Alien Mind”, nhìn lại điểm khởi đầu của việc huấn luyện mô hình suy luận có thể mở rộng trong dự án RLSlow 2023, đồng thời lý giải một cách hệ thống sự khác biệt giữa đối chiếu mục tiêu và đối chiếu giá trị. Bài viết chỉ ra hiệu quả giám sát chuỗi tư duy đang giảm dần khi năng lực mô hình tăng lên, GPT-6 Astra có sự đối chiếu vượt trội so với GPT-5.6 Sol; tác giả dự đoán tiến triển có thể tiếp tục hướng tới tự cải tiến đệ quy máy (RSI), kêu gọi chậm lại việc mở rộng một cách tự nguyện, thiết lập rào cản an toàn bên thứ ba và tăng cường phối hợp quốc tế.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI trình bày dài về thách thức trong việc đối chiếu và giám sát, cho biết năng lực giám sát CoT đang giảm sút - Tin tức AI Aioga","description":"OpenAI phát hành bài dài “An Alien Mind”, nhìn lại điểm khởi đầu của việc huấn luyện mô hình suy luận có thể mở rộng trong dự án RLSlow 2023, đồng thời lý giải một cách hệ thống sự...","url":"https://www.aioga.com/vi/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:27.417Z"},"id":{"title":"OpenAI Menjelaskan Secara Panjang Masalah Penyesuaian dan Pengawasan, Menyatakan Kemampuan Pemantauan CoT Sedang Melemah","summary":"OpenAI menerbitkan artikel panjang berjudul \"An Alien Mind\", meninjau kembali titik awal pelatihan model penalaran yang dapat diperluas dalam proyek RLSlow 2023, serta menjelaskan secara sistematis perbedaan antara penyesuaian tujuan dan penyesuaian nilai. Artikel tersebut menunjukkan bahwa efektivitas pemantauan pemikiran berantai sedang berkurang seiring peningkatan kemampuan model, GPT-6 Astra secara signifikan lebih unggul dalam penyesuaian dibandingkan GPT-5.6 Sol; penulis memperkirakan kemajuan dapat terus menuju perbaikan diri rekursif mesin (RSI), menyerukan penghentian perluasan secara sukarela, membangun ambang keamanan pihak ketiga, dan memperkuat koordinasi internasional.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI Menjelaskan Secara Panjang Masalah Penyesuaian dan Pengawasan, Menyatakan Kemampuan Pemantauan CoT Sedang Melemah - Berita AI Aioga","description":"OpenAI menerbitkan artikel panjang berjudul \"An Alien Mind\", meninjau kembali titik awal pelatihan model penalaran yang dapat diperluas dalam proyek RLSlow 2023, serta menjelaskan...","url":"https://www.aioga.com/id/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:35.923Z"},"th":{"title":"OpenAI อธิบายยาวเกี่ยวกับความลำบากในการปรับให้ตรงและการตรวจสอบ ระบุความสามารถในการตรวจสอบ CoT กำลังลดลง","summary":"OpenAI เผยแพร่บทความยาว \"An Alien Mind\" ทบทวนจุดเริ่มต้นของโครงการ RLSlow ในปี 2023 ที่ยืนยันว่ารูปแบบการให้เหตุผลสามารถฝึกอบรมแบบขยายได้ และอธิบายอย่างเป็นระบบเกี่ยวกับความแตกต่างระหว่างการปรับให้ตรงเป้าหมายและปรับให้ตรงค่านิยม บทความระบุว่าประสิทธิภาพของการตรวจสอบแบบคิดเป็นขั้นตอนกำลังลดลงเมื่อความสามารถของโมเดลเพิ่มขึ้น GPT-6 Astra มีความเหนือกว่า GPT-5.6 Sol อย่างชัดเจนในการปรับให้ตรง ผู้เขียนคาดว่าความก้าวหน้าอาจดำเนินไปสู่การปรับปรุงตนเองแบบหวนกลับของเครื่องจักร (RSI) และเรียกร้องให้มีการชะลอการขยายตัวโดยสมัครใจ สร้างมาตรการความปลอดภัยของบุคคลที่สาม และเสริมสร้างความประสานงานระหว่างประเทศ","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI อธิบายยาวเกี่ยวกับความลำบากในการปรับให้ตรงและการตรวจสอบ ระบุความสามารถในการตรวจสอบ CoT กำลังลดลง - ข่าว AI Aioga","description":"OpenAI เผยแพร่บทความยาว \"An Alien Mind\" ทบทวนจุดเริ่มต้นของโครงการ RLSlow ในปี 2023 ที่ยืนยันว่ารูปแบบการให้เหตุผลสามารถฝึกอบรมแบบขยายได้ และอธิบายอย่างเป็นระบบเกี่ยวกับความแตกต่าง...","url":"https://www.aioga.com/th/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:34.428Z"},"pl":{"title":"OpenAI napisało obszerny artykuł opisujący dylemat dotyczący dopasowania i monitorowania, stwierdzając, że możliwości monitorowania CoT słabną","summary":"OpenAI opublikowało obszerny artykuł zatytułowany \"Obcy umysł\", w którym ponownie analizuje projekt RLSlow z 2023 roku, aby potwierdzić punkt wyjścia treningu skalowalnego modelu wnioskowania oraz systematycznie wyjaśnić różnicę między zgodnością celów a zgodnością wartości. Artykuł wskazuje, że skuteczność monitorowania myślenia opartego na łańcuchu stopniowo maleje wraz z poprawą możliwości modelu, a GPT-6 Astra znacząco przewyższa GPT-5,6 Sol w zgodności; Autor spodziewa się, że postępy mogą być kontynuowane w kierunku Machine Recursive Self-Improvement (RSI), wzywając do dobrowolnego spowolnienia skalowania, ustanowienia progów bezpieczeństwa przez strony zewnętrzne oraz wzmocnienia koordynacji międzynarodowej.","category":"行业动态","source":"OpenAI：官网动态（RSS · 排除企业/客户案例）","aggregationSource":"OpenAI：官网动态（RSS · 排除企业/客户案例）","pageTitle":"OpenAI napisało obszerny artykuł opisujący dylemat dotyczący dopasowania i monitorowania, stwierdzając, że możliwości monitorowania CoT słabną - Aioga Wiadomości AI","description":"OpenAI opublikowało obszerny artykuł zatytułowany \"Obcy umysł\", w którym ponownie analizuje projekt RLSlow z 2023 roku, aby potwierdzić punkt wyjścia treningu skalowalnego modelu w...","url":"https://www.aioga.com/pl/news/cmtq23v6k01aorotwh8xip8r1/","contentTranslated":true,"sourceHash":"f280b64e6812e2e1","translatedAt":"2026-09-06T17:21:45.011Z"}},"evidenceTier":"source-report","reviewStatus":"editorial-selected","indexable":true,"editorialCover":"/page-visuals/topic-timeline.png"}}