Aioga
AI资讯 / 模型更新
返回 AI资讯

Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零

The Decoder:AI News(RSS)Aioga 编辑团队2026-07-25T10:43:36.000Z热度 60

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试...

模型更新The Decoder:AI News(RSS)

今日 AI 情报摘要

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。

在 129 个浏览器智能体测试场景中,攻击成功率为零; 在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。 零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。

中文正文 · AI 翻译

Anthropic 表示 Opus 5 在其自有软件中几乎对提示注入免疫。提示注入:https://the-decoder.com/claude-cowork-hit-with-file-stealing-prompt-injection-days-after-anthropics-launch/,指攻击者通过网页上的隐藏文本等操纵输入,绕过 AI 模型的指令,这在几乎所有情况下对 Opus 5 都失败了。对于浏览器代理,根据系统手册:https://www-cdn.anthropic.com/c5fbac3f0b1280a933ebd26d3cb8bb9f5bdeaf48/Claude%20Opus%205%20System%20Card.pdf#page=76,129 个测试场景下攻击成功率为零。这很重要,因为 OpenAI 在去年 12 月承认提示注入可能永远无法完全解决:https://the-decoder.com/openai-admits-prompt-injection-may-never-be-fully-solved-casting-doubt-on-the-agentic-ai-vision/。在安全公司 Gray Swan:https://www.grayswan.ai/ 进行的一般提示注入测试中,经过 15 次尝试后的成功率从 5.5%(Opus 4.8)下降到 2.0%。

Opus 5 schneidet im Gray Swan IPI-Benchmark am besten ab: Nach 15 Versuchen liegt die Erfolgsrate für Angreifer bei 2,0 %, gefolgt von Mythos 5 (2,6 %) und Fable 5 (2,8 %). | Bild: Anthropic

这个零成功率仅在 Claude Cowork 等产品开启自动模式时有效:https://www.anthropic.com/engineering/claude-code-auto-mode。自动模式叠加了两层防御。第一层在模型处理数据之前扫描输入数据中隐藏的指令。第二层在执行前阻止危险操作。攻击者必须分别击败这两层。没有这两层,Opus 5 的成功率为 3.7%,而 Sonnet 5 实际上表现更好,为 0.93%。只有模型与保护软件结合,才可将成功率降至零。

保持对 AI 的关注。清晰、有用、无废话。

关注 The Decoder 获取 AI 新闻、背景故事和专家分析。

The Decoder:https://the-decoder.com/

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。 Aioga 将其归入「模型更新」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: the-decoder.com

来源: The Decoder:AI News(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-25T10:43:36.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试...

The Decoder:AI News(RSS)2026-07-25T10:43:36.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。