Aioga
AI资讯 / 行业动态
返回 AI资讯

Gary Marcus 警告 OpenAI 即将越过一条 AI 安全红线

Gary Marcus:The Road to AI We Can Trust(RSS)Aioga 编辑团队2026-09-02T03:22:41.000Z热度 58

Gary Marcus 发文警告 OpenAI 正准备越过一条 AI 安全红线,认为其正在探索的新技术可能令思维链监控变得困难甚至不可能。

行业动态Gary Marcus:The Road to AI We Can Trust(RSS)

今日 AI 情报摘要

Gary Marcus 发文警告 OpenAI 正准备越过一条 AI 安全红线,认为其正在探索的新技术可能令思维链监控变得困难甚至不可能。

中文正文 · AI 翻译

《The Information》刚刚爆料,OpenAI 正在尝试一种新技术,这种技术会让模型透露更少的“思考”,从而使其更难以监控:https://www.theinformation.com/articles/secret-technique-behind-openais-astra-model-sparks-security-concerns?rc=dcf9pt&shared=04ff1d10f5a19606。

正如 Zack Korman 和我几天前在这里所论述的,更好的监控可能是防止 Hugging Face 事件发生的因素之一,根据 OpenAI 自己的说法:

他们正在探索的新技术可能会使这种监控变得困难甚至不可能。

去年,一群顶尖学者撰写了一篇非常有趣的论文,现在看来非常相关,题为《思维链可监控性:AI 安全的一个新而脆弱的机会》:https://arxiv.org/abs/2507.11473,我完全同意其中强调的部分:

他们说得完全正确。思维链监控是不完美的(正如 Subbarao Kambhampati:https://rakaposhi.eas.asu.edu/ 和其他人所展示的),但这是我们监控大型黑盒 LLM 的最佳线索之一。虽然线索很细,但为了(小?)性能提升而牺牲它,感觉像是在玩一场危险的游戏。

今晚早些时候,来自 Guidelight.ai 并且是多位离开 OpenAI 安全团队的研究人员之一的 Steven Adler:https://www.dailymail.com/news/article-14335985/OpenAI-steven-adler-quits-warning-risky-gamble-huge-downside-AI-safety.html 说了这句话,并呼应了 Nathan Calvin 的观点:

分享:https://garymarcus.substack.com/p/red-alert-openai-is-poised-to-cross?utm_source=substack&utm_medium=email&utm_content=share&action=share

附注。给喜欢《终结者》梗的朋友们:

你曾说会有一场黑天鹅事件打破 AI 狂潮。它来了。

“不可预测、不可对齐的 LLM 因 OpenAI 需要某个关键而导致主要银行/公共设施倒塌”。

很明显,我们已经彻底完蛋了。

情报判断

Aioga 编辑摘要

Gary Marcus 发文警告,OpenAI 正在探索一种让模型展示更少“思考”的新技术,可能使思维链监控变得困难,甚至无法进行。

背景分析

Marcus 引述 The Information 的报道称 OpenAI 正尝试相关技术,并援引关于思维链可监控性的研究指出,思维链监控并不完美,但被视为观察大型语言模型的重要途径。

Aioga 观点

Aioga 判断:在来源呈现的争议中,思维链可监控性是一项脆弱但重要的安全观察手段;若新技术确实减少可见“思考”,其安全取舍值得审慎评估。

影响与后续

可能影响:模型披露更少思维过程,可能增加外部监控与安全评估难度;但现有材料不足以确认该技术已部署,也不代表其安全影响已经确定,需要等待更多证据。 后续观察:应关注 OpenAI 对相关技术、思维链披露和监控影响的公开说明,并留意后续研究是否验证监控难度变化;现有材料不足以确认风险已经发生。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: garymarcus.substack.com

来源: Gary Marcus:The Road to AI We Can Trust(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-09-02T03:22:41.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Gary Marcus 发文警告 OpenAI 正准备越过一条 AI 安全红线,认为其正在探索的新技术可能令思维链监控变得困难甚至不可能。

Gary Marcus:The Road to AI We Can Trust(RSS)2026-09-02T03:22:41.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。