Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。
独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。
Claude Code 的 auto 模式将于下周默认开启。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm5mk1109hdroy9apis4bb7
Boris Cherny dari Anthropic menyatakan bahwa pelatihan model ini pada dasarnya telah menyelesaikan ancaman injeksi cepat yang ditimbulkan oleh model Claude...
Boris Cherny dari Anthropic menyatakan bahwa pelatihan model ini pada dasarnya telah menyelesaikan
ancaman injeksi cepat yang ditimbulkan oleh model Claude dalam penggunaan di dunia nyata. Tes benchmark oleh peneliti independen menunjukkan bahwa setelah melapisi beberapa pertahanan seperti pelatihan model, deteksi input, dan klasifikasi niat, tingkat keberhasilan serangan injeksi prompt tidak langsung yang belum pernah terlihat dapat turun menjadi sekitar 0. Mode otomatis Claude Code akan diaktifkan secara default minggu depan. 🔗 Baca artikel asli melalui AIHOT · https://aihot.virxact.com/items/cmsm5mk1109hdroy9apis4bb7
Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。
独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。
Claude Code 的 auto 模式将于下周默认开启。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm5mk1109hdroy9apis4bb7
Aioga 编辑摘要:Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。 Aioga 将其归入「行业动态」方向,重点关注它对真实使用和行业竞争的影响。
背景分析:公司与行业类动态需要放在竞争格局、商业化路径、资本信号和监管环境中观察,单条公告不能代表最终结果。
Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。
影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文件、合作落地、收入或用户信号、竞品动作和监管后续。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: x.com
Sumber: @bcherny)
原文链接: Buka sumber asli
Aioga 归档: 查看情报页
Content record: social-summary · Updated: 2026-08-09T18:32:14.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。