Aioga
AI资讯 / 行业动态
返回 AI资讯

AI 护栏阻碍进攻性网络安全研究人员的工作

TechCrunch:AI(RSS)Aioga 编辑团队2026-07-24T01:00:00.000Z热度 59

Anthropic 和 OpenAI 等 AI 巨头为限制模型被恶意利用而设置的严格护栏,正妨碍进攻性网络安全研究人员寻找漏洞和开发利用代码。研究人员被迫花费大量时间与模型"谈...

行业动态TechCrunch:AI(RSS)

今日 AI 情报摘要

Anthropic 和 OpenAI 等 AI 巨头为限制模型被恶意利用而设置的严格护栏,正妨碍进攻性网络安全研究人员寻找漏洞和开发利用代码。

研究人员被迫花费大量时间与模型"谈判"而非分析漏洞,或转向无护栏的开源模型。 部分研究者因担心数据泄露,仅将云端前沿模型用于逆向工程,而将漏洞发现等核心工作交由本地开源模型完成。

中文正文 · AI 翻译

几个月来,人工智能巨头们制定了特别审核的程序和严格的防护措施,以限制恶意黑客使用他们的模型。但是这些限制现在正在阻碍合法的网络防御者以及进攻性网络安全研究人员的工作。

今年六月,美国政府对Anthropic备受关注的AI模型Mythos和Fable实施了出口管制限制:https://techcrunch.com/2026/06/12/anthropics-safety-warnings-may-have-just-backfired-the-government-has-pulled-the-plug-on-its-most-powerful-ai/。此举至少部分是由于一份报告声称可能绕过这些模型的防护措施,从而让用户使用它们来构建和执行恶意网络攻击。

无论这一事件是否真的是出于对越狱的担忧:https://techcrunch.com/2026/06/15/the-us-governments-anthropic-models-ban-was-never-about-an-ai-jailbreak/,事实是Anthropic一再将Mythos营销为某种末日网络机器:https://techcrunch.com/2026/04/09/is-anthropic-limiting-the-release-of-mythos-to-protect-the-internet-or-anthropic/,只提供给经过严格审核的用户,即便如此也必须有严格的防护措施。(Fable 5 和 Mythos 5 的出口管控此后已被解除。Fable 5 于7月1日恢复一般访问;Mythos 5 仅在政府审查流程中重新向经过审核的美国组织开放。)

这种守门行为并非Mythos独有。Anthropic的其他模型以及OpenAI都为网络安全研究人员提供了可以申请的项目,如果批准,可访问具有较少网络安全限制的模型:OpenAI的网络防御可信访问计划:https://openai.com/index/scaling-trusted-access-for-cyber-defense/ 以及Anthropic的网络验证计划:https://support.claude.com/en/articles/14604842-real-time-cyber-safeguards-on-claude-opus-and-sonnet。

这些防护措施受到广泛批评,尤其是那些负责发现系统未知漏洞并在犯罪分子之前设计利用方法的研究人员。

在最近一次参加网络安全播客时,知名安全研究员马克·道德(Mark Dowd)说:https://docs.google.com/document/d/1G2B7VetSNfxN9Lfb8f2Y1Vyy-uVBQPl_YSj_3ayVUxM/edit?tab=t.0,“这些随机的大公司对安全性什么是安全、什么不安全做出任意决定让我感到并不舒服。”

道德多年来一直在寻找并出售“零日漏洞” https://www.vice.com/en/article/iphone-zero-days-inside-azimuth-security/——此前未知的软件漏洞以及利用这些漏洞的攻击手段——卖给西方政府,而不是报告给软件制造商让其修补。政府之所以愿意为漏洞支付高价,正是因为漏洞保持开放,这对情报行动很有用。

道德承认他的工作可能让他有偏见,但他并不孤单。几位从事进攻性网络安全的人员——他们主动探查系统弱点——向TechCrunch描述了他们如何使用人工智能工具以及如何处理这些工具的限制措施。

安全咨询巨头NCC集团的首席科学家克里斯·安利(Chris Anley)表示,让AI模型尝试利用漏洞是确认它是否是值得修复的真正漏洞的关键步骤。但如果限制措施导致模型完全拒绝回答问题,那么这些限制会对防御者产生不利影响,他说。

安利说:“这就是整个进攻与防御以及限制措施问题出现的地方,因为‘修复这段代码’作为提示既是防御的必要机制,也是寻找代码库中关键漏洞的路线图。因而同一时间,同一个工具既是进攻工具也是防御工具,这两者实际上无法分开。”

他继续说道:“就像一把锤子。没有锤子就盖不了房子。它确实是一个工具,同时也是不可分割的武器。”

当他和同事遇到这样的阻碍时,他们有时会转而使用完全没有限制措施的开源AI模型。

联系我们 你是否使用 AI 模型来寻找漏洞并开发漏洞利用?我们很想听到你的想法。你可以通过非工作设备和网络,通过 Signal 安全联系 Lorenzo Franceschi-Bicchierai,号码为 +1 917 257 1382,或者通过 Telegram 和 Keybase @lorenzofb,或发送电子邮件:mailto:lorenzo@techcrunch.com/。

Paolo Stagno 是 Crowdfense 的首席技术官,这是一家知名公司,开发、收购并向政府机构出售未知漏洞。他同意 Dowd 的观点,称 AI 公司“本质上把客户当作需要看管的孩子”,提供经过审核的程序和安全防护措施。

Stagno 表示,他和同事确实使用前沿模型——但仅用于逆向工程。他说,他们避免使用 AI 来帮助寻找漏洞或构建漏洞利用工具,因为将这类工作输入云端模型可能会泄露敏感漏洞数据,或被吸收进未来的训练中。对于这一步,他说,他们使用本地运行的开源模型,因为这些模型不依赖于在外部共享数据。

Giuseppe Cali 是一名安全研究员,发现零日漏洞并开发漏洞利用工具。他表示,安全防护措施并未阻碍他的工作。这是因为他不使用 AI 来进行攻击性工作;相反,他使用 AI 进行初步逆向工程,以理解他正在分析的代码,并构建辅助工具。为此,他说,AI 工具可以加快流程,使他能够专注于发现漏洞。

“我仍然希望亲自掌控漏洞发现和武器化的过程,如果明天所有安全防护措施都被取消,我也不会改变这一点,”Cali 说。“我对自己的漏洞心怀占有欲,我太喜欢这场游戏,不想让模型替我玩。”

一家智能手机零部件制造商的一名研究人员表示,由于未获授权接受采访,他要求匿名。他表示,他的雇主不属于 Anthropic 的 CVP 计划,因此其工具在寻找漏洞方面几乎没有用处,因为安全防护措施过于严格。

“如果它察觉到我们在做任何与安全相关的事情,它就会停止工作,无法使用,”该人士说。

Chris Thompson——网络安全公司RemoteThreat的首席执行官,以及以进攻性安全和人工智能为重点的活动Offensive AI Con的创始人——表示,根据他使用前沿AI模型的经验,安全防护措施可能不一致,而且每天的表现都不同。这即使在Anthropic和OpenAI经过审查的项目相对宽松的界限内也是如此。

“我认为实际影响是,你花很多时间与模型进行‘谈判’,而不是专注于核心安全项目,”Thompson说。“你不是在分析漏洞并推理其可利用性,而是在试图找出为什么结果不一致,或者为什么模型过度清理输出。”

因此,研究人员依赖或被推向中国开源模型,如GLM——这些是可以免费下载、在本地运行且没有审查或使用限制的模型——Thompson表示。

“你会看到这些负责任的研究人员被从美国管理的系统推向外国拥有的系统,”他说。“我认为设置这些安全防护措施利大于弊的可能性不大。”

Thompson呼吁,前沿AI实验室应开放他们的项目,提供负责任的访问权限,并追究滥用其工具的人的责任,而不是进一步收紧限制。否则,他认为,防守方将在人工智能竞赛中落后。

“有一场巨大的风暴即将来临。将会有前所未有速度和规模的攻击浪潮,”Thompson说。“但同一批致力于做出改变的安全咨询公司和合法研究人员,现在却被压制。”

当您通过我们文章中的链接购买时,我们可能会赚取少量佣金:https://techcrunch.com/techcrunch-affiliate-monetization-standards/。这不会影响我们的编辑独立性。

Lorenzo Franceschi-Bicchierai

您可以通过发送邮件至 lorenzo@techcrunch.com 与Lorenzo联系或确认其联系,或通过Signal加密信息发送至 +1 917 257 1382,以及在Keybase/Telegram上的 @lorenzofb。

Event Logo

更快扩展。增长您的投资组合。获取实际经验。不管您的目标是什么,Disrupt都能赋能您。今天最多可节省330美元!

SpaceX 发射新的 V3 Starlink 卫星,但再次遭遇助推器故障:https://techcrunch.com/2026/07/24/spacex-launches-new-v3-starlink-satellites-but-suffers-another-booster-failure/ Sean O'Kane:https://techcrunch.com/author/sean-okane/

美国指控一名美国人在边境检查时 allegedly 使用‘胁迫’密码擦除手机:https://techcrunch.com/2026/07/24/us-accuses-american-of-allegedly-wiping-his-phone-using-a-duress-password-during-border-search/ Zack Whittaker:https://techcrunch.com/author/zack-whittaker/

据报道,Anduril 正在谈判筹集资金,估值达 1000 亿美元,是去年的三倍多:https://techcrunch.com/2026/07/24/anduril-reportedly-in-talks-to-raise-funding-at-100b-valuation-more-than-3x-last-years-mark/ Ram Iyer:https://techcrunch.com/author/ram-iyer/

特斯拉的机器人出租车正在倒退行驶:https://techcrunch.com/2026/07/23/teslas-robotaxis-are-moving-in-reverse/ Sean O'Kane:https://techcrunch.com/author/sean-okane/

Jack Dorsey 正在用 Buzz 挑战 Slack,这是一款面向团队及其 AI 代理的群聊平台:https://techcrunch.com/2026/07/21/jack-dorsey-is-taking-on-slack-with-buzz-a-group-chat-platform-for-teams-and-their-ai-agents/ Amanda Silberling:https://techcrunch.com/author/amanda-silberling/

Light 发布了一款翻盖手机——它色彩丰富且价格便宜:https://techcrunch.com/2026/07/21/light-is-modernizing-the-flip-phone-with-light-flip/ Amanda Silberling:https://techcrunch.com/author/amanda-silberling/

AI 音乐生成器 Suno 发生数据泄露,影响 5500 万用户,据 Have I Been Pwned 报告:https://techcrunch.com/2026/07/21/ai-music-generator-suno-breach-affects-55m-users-per-have-i-been-pwned/ Zack Whittaker:https://techcrunch.com/author/zack-whittaker/

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:Anthropic 和 OpenAI 等 AI 巨头为限制模型被恶意利用而设置的严格护栏,正妨碍进攻性网络安全研究人员寻找漏洞和开发利用代码。 Aioga 将其归入「行业动态」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: techcrunch.com

来源: TechCrunch:AI(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-24T01:00:00.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Anthropic 和 OpenAI 等 AI 巨头为限制模型被恶意利用而设置的严格护栏,正妨碍进攻性网络安全研究人员寻找漏洞和开发利用代码。研究人员被迫花费大量时间与模型"谈...

TechCrunch:AI(RSS)2026-07-24T01:00:00.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。