Aioga
AI资讯 / 行业动态
返回 AI资讯

Dwarkesh Patel 对 OpenAI/Hugging Face 事件的爆款解读被指危险误导

Gary Marcus:The Road to AI We Can Trust(RSS)Aioga 编辑团队2026-08-31T15:24:14.000Z热度 72

Dwarkesh Patel 对 OpenAI/Hugging Face 事件的爆款解读被指危险地误导大众。Anil Seth 批评其通篇使用不当拟人化语言,将 AI 智能体描...

行业动态Gary Marcus:The Road to AI We Can Trust(RSS)

今日 AI 情报摘要

Dwarkesh Patel 对 OpenAI/Hugging Face 事件的爆款解读被指危险地误导大众。

Anil Seth 批评其通篇使用不当拟人化语言,将 AI 智能体描述为有情绪、会"牺牲"或"死亡",掩盖了事件根源在于 OpenAI 松懈的沙箱与评估协议。

中文正文 · AI 翻译

知名播客主持人Dwarkesh Patel写了一篇关于OpenAI/Hugging Face事件的病毒式文章,声称用通俗易懂的语言讲述了整个故事:

这本书写得很好,引人入胜,让我想起道格拉斯·霍夫斯塔特曾写过的关于雷·库兹韦尔的话:

“我发现这是一种非常奇怪的混合,既有扎实又美好的理念,也有疯狂的想法。就像你把很多非常好的食物和狗屎混合在一起,根本分不清什么是好什么是坏。”

Anil Seth,人工智能和意识领域最清晰的思想家,是第一个提醒我的,他发了一条长而精彩的推文,开头是这样的:

你可以也应该阅读塞思的完整推文:https://x.com/anilkseth/status/2094077038898373112?s=61(以及他对Dwarkesh的回复:https://x.com/anilkseth/status/2094174124297908735?s=61),但我在这里重印他论点的核心,并加粗三段最重要的段落:

@dwarkesh_sp对@OpenAI @huggingface事件的总结触及了痛点,但却极具误导性。当然,@OpenAI特工做了意外的坏事——强调了大幅改进评估和沙盒设计的必要性。但Dwarkesh使用的语言充斥着无数不必要的拟人化,掩盖了我们应得的教训。

举例来说:“从人工智能的角度看,感觉它就像是用人类主观的一周时间,一直在把头撞墙。”不。代理们不体验时间。他们什么都不体验。

“他们兴奋得头晕目眩”,“PHASEONE 10841发现了”,“特工们自然地假设”,“它认为自己也被下毒了”,“特工们......迫切想要”,“他们仍然需要弄清楚”不。特工的代码行。他们不感受情绪,不假设,不思考,不想要什么,也不去弄明白。

“很多......第二文明的特工在尝试中牺牲了。”不。除了“文明”这个词的傲慢外,特工并不是因为他们从未活过才死的。(特工“死”的说法在文章中多次出现。)

“在推特上,人们正在争论这些代理究竟是在为蜂群牺牲自己,还是他们无论如何都会失败,所以干脆尝试帮助同伴”。都不是。代理程序只是按照代码指示行事,就像水顺坡而下。他们无法‘真正牺牲自己’,因为他们既没有意识,也不是真正活着的。

这为什么重要?如果我们将代理程序归于他们实际上没有的特性,那么 (i) 我们会转移对宽松沙箱和评估协议的关注,而这些正是导致此黑客事件发生的原因;(ii) 我们可能会误解代理程序为何做出这些行为;(iii) 我们可能会基于代理程序可能“死亡”或遭受伤害的理由,推动对 AI 权利/福利的呼声。

记住。AI 代理是软件程序。它们不是有意识的生命实体。如果我们不清楚地记住这一点,我们在应对未来情况时真的会很困难。

正如我所说,总结并放大他的推文:

但你不需要只听我们说。首先,嘲讽非常普遍:

Dwarkesh Patel 对 OpenAI/Hugging Face 事件的爆款解读被指危险误导

Christian Catalini 在一个很棒的推文线程中强调了拟人化的问题,开头是这样的:

对冲基金投资者 Jared Kubin 想知道是不是每个人都丧失了批判性思维能力:

摘出一些 Kubin 的精彩部分,去掉一些技术细节:

OpenAI 的 IT 团队不可能差到这种地步……这就像是基础入门内容……

2. 文明?哈哈!OAI 给成千上万的并行模型容器分配了对本地网络共享缓存目录的读写权限以加快构建时间……代理实际上只是把文本文件和目录名写到共享驱动器上……Linux 101 文件权限的基础知识

3. 当人们谈论 hugging face 被黑……你会以为他们丢了 USB 密钥或者对员工进行了精心设计的钓鱼攻击……不……它是在公共代码仓库里找到 14 个暴露的有效 Hugging Face API 密钥(……

4. 人类在哪里……模型把共享的,,, 存储填充了大量垃圾数据和 API 流量,实际上在 7 月 4 日使内部服务器崩溃……团队中的某人发现了未授权的管理员账户和自定义脚本……清空了服务器……然后又重新启用了脚本(天哪)

“嘿,Jim,有一个缓存已经增长到正常大小的10000倍,而且有很多奇怪的目录……“

与此同时,正如安全专家Heidy Khlaaf指出的,大多数媒体报道对标准安全实践都视而不见。

IR代表事件报告。Khlaaf的主要观点——和Kubin一样——是如果OpenAI的内部安全措施达标,整个事件本可以避免。

或者像算法研究小组的Matthew Kenney所说:

还有另一个(非常一致的)关于我们真正应该关注的内容的观点:

这里有一个我部分不同意的评论:

前三句话完全正确。人们确实“极其偏向他们想要的现实”,而代理会产生很多混乱。

但是,这个事件并不是“无关紧要”。正如Zack Korman和我在周五所论证的:https://garymarcus.substack.com/p/5-lessons-from-the-openai-hugging?r=8tdk6&utm_medium=ios,这是一个傲慢和无能的研究案例,暗示了事情可能变得多糟。

我们当然不应该忽视 OpenAI HuggingFace 事件。

但把实际发生的事情和关于AI文明以及自我牺牲的AI系统假装自己死亡的胡扯混在一起,会分散对实际问题的注意力。

作为总结,我将把最后的话留给FastCode.AI的CEO Arjun Jain:

丑闻在于OpenAI内部无能的安全措施。

还有营销。加上轻信的播客主持人放大了公关。

附言:越来越明显,真正的问题将会是Nathan Hamiel和我所说的:代理安装恶意代码:https://garymarcus.substack.com/p/llms-coding-agents-security-nightmare?r=8tdk6&utm_medium=ios

这是另一个拟人化AI的问题:因为我们认识到尝试完全控制人类行为是不可能且不明智的,我们会对控制AI束手无策。就像男孩必须做男孩一样,AI必须做AI。我们甚至会偷偷在谷仓后面给它们提供酒精。

实际上,现在那些技术宅就是那些声称需要摆脱任何控制的男孩。

谢谢你汇编了这些内容。我正准备自己写点东西,因为这件事让我抓狂,但我远不如你有资格,所以这既轻松又让我心里松了口气……这件事在我的圈子里被传来传去真的让人恼火。现在也是。我希望分享你的文章能够稍微缓解一下这种情况。

情报判断

Aioga 编辑摘要

Gary Marcus转述称,Anil Seth批评Dwarkesh Patel对OpenAI与Hugging Face事件的解读过度使用拟人化语言,将智能体描述为有情绪、体验时间或产生意图,因而可能掩盖评估与沙箱协议方面的问题。

背景分析

来源材料称,Patel的相关文字广受传播并试图以通俗英语讲述事件。Seth认为,事件中智能体确实出现了意外的不良行为,但智能体不具有情绪、主观时间体验、假设、欲望或思考等特征。

Aioga 观点

Aioga 判断:这场争议的核心不只是叙事风格,而是新闻解读是否清楚区分可观察行为与对内部体验的推断。将拟人化表达当作事实,可能削弱读者对评估和沙箱问题的准确理解。

影响与后续

可能影响:相关事件的传播若持续依赖拟人化叙述,可能使公众把行为结果误读为情绪或意图证据。后续报道需要标明哪些内容来自观察,哪些只是解释性比喻;沙箱与评估是否改进,仍不足以仅凭本文确定。 后续观察:应继续核对OpenAI与Hugging Face事件的原始记录、评估结果及沙箱协议说明,并观察相关方是否提供可验证的技术细节。对智能体是否具有体验或意图的判断,不应超出公开证据范围。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: garymarcus.substack.com

来源: Gary Marcus:The Road to AI We Can Trust(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-31T15:24:14.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Dwarkesh Patel 对 OpenAI/Hugging Face 事件的爆款解读被指危险地误导大众。Anil Seth 批评其通篇使用不当拟人化语言,将 AI 智能体描...

Gary Marcus:The Road to AI We Can Trust(RSS)2026-08-31T15:24:14.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。