Aioga
AI资讯 / 技巧观点
返回 AI资讯

AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元

Hacker News 热门(buzzing.cc 中文翻译)Aioga 编辑团队2026-07-15T16:25:19.955Z热度 72

2025年夏季,美国佛罗里达州一名退休老人接到"女儿"哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员--实际上,哭声是从一段音频片段合成的AI语音。FBI...

技巧观点Hacker News 热门(buzzing.cc 中文翻译)

今日 AI 情报摘要

2025年夏季,美国佛罗里达州一名退休老人接到"女儿"哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员--实际上,哭声是从一段音频片段合成的AI语音。

FBI 2026年4月报告首次将AI欺诈列为独立类别,2025年收到超2.2万起AI相关投诉,调整后损失超8.93亿美元,其中60岁以上受害者占3.52亿美元。

中文正文 · AI 翻译

莎伦·布赖特韦尔听到电话那端女儿的哭声,那一刻结束了她可能采取的任何防御。每一种本能都在告诉她,那声音属于艾普丽尔:相同的声调,相同的年轻女性痛苦不安的断裂节奏。声音说她在开车时发短信,撞到了一名孕妇,手机已被警方查封。随后,一个男人接管了电话,自称是艾普丽尔的律师,并解释说保释金需要现金一万五千美元。他警告布赖特韦尔不要告诉银行钱的用途,因为这可能会损害她女儿的信用。在一个小时内,这位来自佛罗里达州多佛的退休老人取出了钱,并交给了她认为与法院有关的快递员。直到她找到了真实的艾普丽尔——整上午都在上班,从未接近过车祸——她才明白女儿没有打过这个电话。没有任何人打过。哭声是从一段音频片段合成的,而她以为自己在救援的女儿,只存在于别人机器中的数字模式中。

AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元

2025年夏天,美国地方新闻报道了布赖特韦尔的损失,如今已成为美国最普通的犯罪之一。这也是技术上最先进的犯罪之一。这两个事实的碰撞——需要机器学习的绝对前沿技术才能实施的诈骗,可以针对普通奶奶在她的厨房里大规模发动,成本几乎为零——构成了执法部门、银行、电信公司和监管机构两年来无法控制的问题的核心特征。问题不再是技术是否有效。它令人震惊地非常有效。问题是,当攻击的复杂程度与目标的认知之间的差距以年,而非月为单位衡量时,真正具有意义的保护需要什么。

2026年4月,联邦调查局(FBI)的互联网犯罪投诉中心发布了上一年的网络犯罪年度报告,这是该报告26年历史上首次将人工智能相关的诈骗作为一个独立类别进行统计。数字令人震惊。局方记录了超过22,000起涉及人工智能的投诉,调整后的损失总额超过8.93亿美元。在这笔损失中,报告将3.52亿美元归因于60岁及以上的受害者,使老年人成为人工智能金融犯罪中最主要的目标群体。人工智能相关数额仅是更大总额的一部分:美国全国的网络犯罪损失在一年内增加了26%,达到209亿美元,60岁及以上的美国人占其中的77亿美元——比上一年大约增长了60%。

FBI坦言,即便是这些数字也低估了问题。报告中的人工智能归因仅反映了受害者认识到并报告的情况,而大多数被克隆语音电话欺骗的受害者根本不会意识到机器的参与。他们会像Sharon Brightwell最初相信的那样,以为自己在与自己的孩子通话。因此,8.93亿美元应被视为下限而非上限——这是一个本质上设计为对受害者隐形的类别的可见部分。FBI迫于形势而必须创建这个类别,这本身就是一个信号。犯罪统计数据是保守的工具;机构不会因为一时时尚而重新绘制一个有26年历史的报告分类系统。账目中新增加的这一行,实际上承认了一种三年前在消费领域几乎不存在的工具,如今已经成为主流盗窃手段。

在国际上,形势更大且恶化。2026年3月,国际刑警组织发布了第二版全球金融欺诈威胁评估报告,估计2025年全球因金融欺诈造成的损失达4420亿美元——这一数字相当于丹麦全年经济总产出的总和。该组织将威胁趋势评定为上升,并描述了所谓的“欺诈工业化”:欺诈从机会主义个人行为转向与人口贩运和网络犯罪交汇的有组织的跨国行动。关键的是,国际刑警组织发现,借助人工智能的欺诈比传统欺诈的盈利大约高四倍半,并且所谓的自主型人工智能系统现在可以自主策划和执行整个欺诈行动,从侦查到赎金要求。换句话说,其经济学已发生逆转。工业规模的欺骗首次几乎零成本制造,却能带来巨额回报。

贯穿祖孙骗术的核心技术能力描述起来极其简单。现代人工智能语音克隆系统只需三秒的音频,就能生成在实际使用中几乎无法与原声区分的合成语音。三秒的长度可能是一段语音邮箱问候、一小段播客音频,或发布在公开Instagram账号上的生日视频音频。原始材料并非从安全数据库中被窃取,而是每天通过普通的记录生活行为自愿提供。一个出现在单个TikTok视频中的孙子孙女,就为骗子提供了制造自己绑架骗局所需要的一切。

威胁之所以急迫,不仅仅是因为克隆技术可行,还因为实现它的工具廉价、丰富且几乎完全没有监管。2025年3月,《消费者报告》评估了六家公司的语音克隆产品——Descript、ElevenLabs、Lovo、PlayHT、Resemble AI 和 Speechify——并得出结论称,绝大多数产品缺乏任何有效的防止欺诈或滥用的保护措施。该机构发现,其中四款产品仅要求用户勾选一个方框,确认他们有合法权利克隆所涉及的语音。这四款产品中没有任何一款使用任何技术手段来确认发声者确已同意,或限制克隆仅用于用户自己的声音。六家公司中有四家仅需用户名或电子邮件地址即可开设账户。调查的直白结论,由NBC新闻和《注册报》放大报道,是该行业已经研发出一种能够模仿任何人的工具,而且只需用户自我声明勾选一个复选框即可使用。

ElevenLabs,作为最知名的服务商之一,提出了多层次的安全计划:禁止滥用政策禁止冒用身份、公开的AI语音分类器可以识别可能由其系统生成的音频、可追溯性将生成内容链接回产生该内容的账户、以及“禁用语音”保护措施,在选举周期内阻止克隆某些受保护的公众人物的声音。这些措施并非小事,并且比一些竞争对手提供的更多。但它们存在结构性弱点:几乎所有措施都是事后操作。它们帮助调查人员在欺诈已经发生、受害者已经失去储蓄后,确定来源。它们对防止三秒钟的克隆在一开始被生成几乎没有作用,因为阻止克隆发生的关键——被克隆者已明确同意的强制性、稳健的验证——恰恰是一个竞争激烈、快速发展的市场不愿意强加给自己的摩擦。当一项保护措施只会导致公司失去转换率,却只能保护竞争对手的客户时,市场不会自愿提供。事实也是如此。

如果有一个瞬间能够说明基于检测的防御为什么会失败,那么它就是出现在2026年6月《纽约时报》的一篇专题报道中。报道的主角是哈尼·法里德(Hany Farid),加州大学伯克利分校的教授,他被广泛认为是全球深度伪造取证领域的首席权威。二十多年来,法里德一直以区分真实与合成内容的能力建立了自己的职业生涯,接受过政府、人权组织、记者和执法部门的请求。最近,《纽约时报》报道说,他开始在自己的测试中失败。“我感觉自己快看不见了,”他说。地球上最有能力区分真实录音和AI生成内容的人已经无法可靠地区分了。

这个承认本应终结某种类型的讨论。多年来,对合成媒体的应对隐含承诺一直是检测能够跟上生成的步伐——即每出现一个更具说服力的伪造,就会有一个更敏感的检测器,而这场军备竞赛虽然令人不适,但至少是可赢的。法里德的坦白证明,至少在音频领域,这场竞赛已经失败。当该领域最顶尖的检测者也只能依靠抛硬币做判断时,那种在伪造生成和传播后才去捕捉的策略根本不算策略。它只是一种希望。而一种依赖二十分钟恐慌的欺诈行为,不会给受害者或其银行二十分钟时间进行即使是哈尼·法里德也不再信任的取证分析。

这是有意义的保护要求我们首先接受的最重要的一点:检测不能成为承重防御。一位正在电话中听到哭泣声音的祖母,不可能被期望进行该学科领先专家已经有效放弃的取证分析。任何最终依赖目标个体或其他人能够区分真实声音与克隆声音的计划,已经过时。这一含义不仅限于电话诈骗。如果全球音频合成检测权威都无法信任自己的判断,那么每一个默默假设人类可以充当备用验证者的下游系统——银行柜员被告知“自行斟酌”,亲属被敦促“仔细听是否有异常”——都建立在一个已经崩塌的基础上。

将针对老年人的行为归因于天真是诱人但错误的。本文章所依据的简介指出了一个更令人不舒服的事实:使老年人特别容易受到攻击的特征并不是智力缺陷,而是经过充实生活之后的特征。他们通常拥有较高的平均储蓄余额,这是几十年劳动积累的结果,这使他们成为高效的目标——一次成功的电话可能带来的收益远超过针对年轻人的一次尝试。他们是在既定的信任型交流模式中成长,并且仍在其中运作的,这种模式下,对焦虑亲友的电话,会被视为真实的紧急情况而非潜在的攻击来盘问。他们由于自身原因并不熟悉AI语音合成的存在,毕生生活在一个电话里的声音就是电话那端真实人的世界中。同时,他们也像每个父母和祖父母一样,会暴露在家庭紧急情况的特定情感架构中,在这种情况下,保护子女的本能会盖过所有较慢、更怀疑的判断。

学术研究已经开始将这一现象形式化。2026年6月发表在arXiv上的一篇论文直接指出,“老年人仍然在AI增强的诈骗中处于不成比例的脆弱状态。”另一项由邹益新领导的团队在2026年初发表的研究,针对在日益复杂的AI环境下专门为老年人设计的欺诈干预措施,开发了一种基于角色的模拟工具ROLESafe,该工具通过让参与者扮演受害者或帮助者而非被动观察者,从而提高了他们识别欺诈的能力。第三篇论文来自Charm Security公司的研究人员,他们提出了一个“人类脆弱性与利用框架”——一个结构化的分类表,基于软件安全领域的漏洞数据库,用于分类诈骗系统所利用的认知和社会机制。该框架的前提本身就是一种沉默的控诉:安全行业几十年来一直在记录和修补机器的弱点,却忽视了对人的弱点进行记录和管理。祖父母诈骗之所以成功,是因为它攻击了系统中从未被修补的那一部分。

这就是为什么面向老年人的宣传活动虽然必要,但并不足够。诈骗利用的情绪机制不是宣传单能够填补的知识空白;它是一个人对孙子的爱被武器化。你可以告诉某人一百次,声音可能被伪造,可在那一刻,当克隆的声音呼救时,知识不会及时到达。新加坡海峡时报和马尼拉时报在2026年6月转载的AFP电讯引用了语音安全公司Pindrop的阿米特·古普塔的话,精确地指出了问题:“目标不是完美复刻声音。目标是创造足够的情绪不确定性和紧迫感,使受害者在核实之前就采取行动。”以受害者会核实为前提的防御,是对攻击所设计绕过的弱点所构建的防御。

那篇电讯报道中最令人毛骨悚然的证词并非来自一位年老的受害者,而是一位律师。费城律师加里·希尔德霍恩本人也曾成为克隆语音诈骗的目标,他说,即便事后回想并怀有职业怀疑,他仍无法摆脱自己听到的声音的确定性:“我会带着誓言上路,那就是你的声音。”任何倾向于认为警惕就能解决问题的人都应该读懂这句话。希尔德霍恩是一位受过培训的律师,受薪于讯问证据和怀疑合理故事,但克隆声音同样彻底击败了他,就像击败惊慌的祖母一样。该诈骗利用的脆弱性不仅存在于老年人、轻信者或技术不熟练者中。它存在于人类的听觉系统本身,这一系统经过数千年的进化,把熟悉的声音视为熟悉的人的证明——而现在,在这漫长历史的第一次,它被系统性且可利用地误导了。

有关老年人的数据强化了这一重构观点,而非与之矛盾。联邦贸易委员会(FTC)在2025年12月向国会提交的报告发现,2020年至2024年间,60岁及以上人群报告的诈骗总损失大约增加了四倍,达到了约24亿美元,其中68%的金额来自个人损失10万美元或以上。考虑到羞耻和尴尬导致的长期未报告,机构自身对实际年度损失的估计高达815亿美元。这些数字并不是轻信少数人而被夺走零用钱的情况,而是一代人积累的储蓄通过一种专门针对他们的信任模式、财务状况和家庭情感中心位置设计的机制被掏空的数字。

安全公司Adaptive Security的首席执行官布赖恩·朗(Brian Long)向法新社简明扼要地总结了这种新经济:“一个房间里带着键盘的人可以制造无限数量的攻击者。”这就是不对称性的最纯粹形式。一方面是一个自动化系统,可以在几秒钟内生成一个逼真的克隆,拨打成千上万个号码,并用合成情绪进行每一次对话,其边际成本几乎为零。另一方面是一个个体人类,通常年迈、孤独,只能在一次恐慌电话的长度内进行防御,而即便是世界顶尖的法医科学家也无力做到。

2026年,美国联邦调查局、美国银行家协会和消费者权益组织广泛传播的建议是,家庭应商定一个“安全词”——只有家人知道的秘密短语,在任何紧急电话中都需要提供。如果声音无法说出该短语,则挂断并拨打已知号码。这个建议是合理的。它也同时作为一种系统性防御措施,显得完全不足,并且值得明确说明原因。

安全词只有在每个家庭成员都采纳、记住它,并且有足够的冷静在刻意要求使用时才有效,而这正是刻意摧毁冷静的。它把击败一个工业化、自动化、价值数十亿美元的犯罪机器的全部重担,都放在了一个在一周中最糟糕时刻,恐惧的个体进行认知训练。它假设这位80岁的老人,根据2025年底发布的联邦贸易委员会数据,其中位数报告损失超过1600美元,会在听到孙子尖叫时,冷静地回忆起一套程序并执行。有些人会。很多人,出于设计,不会。只有在目标在最大压力下完美表现时才有效的防御不是防御;这是一种事后将责任归咎于受害者的方式。

这正是将保护交给家庭和个人更深层次的反对。它将技术和金融体系失败的责任转嫁给最不具备承担责任的人,而当他们失败时,又将失败视为个人的失败。语音克隆工具由公司制造和销售。这些通话由电信网络承载。资金通过银行流动。这些各方都处于关键节点,欺诈实际上可以大规模被拦截。奶奶在厨房里却没有。有意义的保护需要将负担从链条末端的位置转移到它应在的中间点。一个通过向最脆弱成员提供更好建议来应对工业化威胁的社会,混淆了发布指导意见与提供保护。

逐一考虑这三个制度性瓶颈,因为每个瓶颈都展示了结构性防御的前景与当前的失败。

第三个瓶颈——也是最有希望的——是银行。这是金钱实际流动的地方,因此也是拦截机制作用最强的地方。英国提供了最清晰的自然实验。2024年10月,支付系统监管机构(Payment Systems Regulator, PSR)要求对授权推送支付(APP)诈骗进行必需的赔偿:如果受害者被欺骗授权向欺诈者转账,汇出和接收银行现在必须对其进行赔偿,责任各承担一半,上限为85,000英镑,并在五个工作日内完成,同时明确禁止对弱势客户适用消费者疏忽例外条款。账户名称确认服务(Confirmation of Payee)现在在数十亿笔交易中运行。PSR自有的仪表盘显示,截至2025年12月底的15个月内,因这种诈骗损失的钱款中有89%——约2.43亿英镑——得到了赔偿,而在规则生效前,赔偿率为65%。

综合这些线索,就能勾勒出一个连贯的图景,展示什么才是真正有效的,而不仅仅是听起来令人安心的措施。

首先,它要求放弃将检测作为主要防线。Hany Farid所说的盲点并不是可以通过更好的分类器解决的暂时性挫折;它是生成技术已经超越识别能力的世界中的永久结构性状况。任何最终防护依赖于某人在某地分辨真假内容的计划,都已经失败。

第二,它要求规范武器的供应。消费者报告(Consumer Reports)指出语音克隆工具隐藏在自我证明的复选框背后,这是政策选择,而非自然法则。在语音被克隆之前强制要求可验证的同意——Descript和Resemble AI部分实现了这种措施,而其他公司尚未——在技术上是可行的,并不会取消该技术的合法用途。欧盟的《人工智能法》(AI Act),其对通用模型的义务在2025年和2026年开始实施,以及州法律如田纳西州的ELVIS法案,要求书面同意才能克隆语音,都是将语音合成作为一种需监管能力的早期尝试。它们在执法方面仍远未跟上威胁的发展步伐。

第三,它要求将阻止责任的负担放在占据关键节点的机构上——在它们不自愿行动时,通过责任强制执行。英国的赔偿机制并不完美也不完整,但它展示了这一机制:当银行承担损失时,银行就会建立阻力。通过通话获利的电信运营商应承担相应的责任,对通话进行身份验证并在可能的情况下标识。出售克隆服务的平台应承担验证同意的责任。共同的原则是,责任应当落在既有能力防止危害又从引起危害的活动中获得商业利益的一方——在每种情况下,这都是机构,而不是一个八十岁的老太太接听电话。

第四,它要求将人类脆弱性视为需要管理的对象,而不是需要指责的对象。Charm Security 框架的洞见——欺诈所利用的认知和情绪机制应像软件缺陷一样被系统化记录——应当指导银行如何设计干预措施,运营商如何设计警告,以及公共机构如何设计教育,从而超越传单,实行 ROLESafe 研究发现能够实际改变行为的角色扮演演练。宣传活动和家庭安全用语并非无用,它们只是最后的、最弱的防线,仅作为结构性防御的备用,而结构性防御才是真正发挥作用的部分。

防御差距以年计而非月计的最深层原因是,攻击是技术问题而防御是制度问题。克隆一个声音只需三秒钟,并且每月都有改进。而制定赔偿法规、改造银行系统的欺诈控制、在整个行业强制执行同意验证、以及关闭国家电话网络中的非知识产权漏洞则需要数年,因为它们涉及法律、协调、资金以及克服所有从现状中获利的商业利益。这种不对称不仅是技术上的;它是不对称的表现,是机器构建的速度和社会应对速度之间的差异。

沙朗·布赖特韦尔(Sharon Brightwell)最终通过调查人员和她的银行的尽职努力收回了一部分钱。很多人却没有。联邦调查局(FBI)将3.52亿美元归因于老年AI诈骗受害者,而他们无法统计的更大金额,代表着财富从那些最不可能承受损失的人手中,转移到有史以来最高效的犯罪企业手中。弥合这一差距,并不是通过教祖母怀疑孙辈声音的真实性来实现的。它将通过法律和工程方式作出决策——即位于克隆与现金之间的机构,应对其处理的资金负责。在这一决策作出之前,这种“三秒钟盗窃”仍将是世界上最容易实施的严重犯罪,同时也是受害者最难被相信的犯罪——因为证据本身设计得完全像他们所爱之人的声音。

Tim Green

Tim Green 英国系统理论家与独立技术作家

Tim 探索人工智能、去中心化认知与后人类伦理的交汇点。他的作品发表于 smarterarticles.co.uk:https://smarterarticles.co.uk,挑战科技进步的主流叙事,同时提出跨学科的集体智能和数字管理框架。

他的文章曾在 Ground News 上刊登,并被学术和技术社区的独立研究者分享。

ORCID: 0009-0002-0156-9795:https://orcid.org/0009-0002-0156-9795 邮箱:tim@smarterarticles.co.uk:mailto:tim@smarterarticles.co.uk

收听每周免费的 SmarterArticles 播客:https://www.smarterarticles.fm

讨论...:https://remark.as/p/smarterarticles.co.uk/the-three-second-theft-why-ai-voice-fraud-outruns-every-defence

发表于 write.as:https://write.as/

情报判断

Aioga 编辑摘要

材料称,佛罗里达州退休老人莎伦·布赖特韦尔接到合成其女儿哭声的诈骗电话,在对方虚构车祸、保释金和保密要求后,于一小时内取出1.5万美元并交给冒充法院关联人员的快递员。

背景分析

正文称,合成哭声来自一段音频片段。FBI在2026年4月发布的上一年度报告中首次单列AI欺诈,记录逾2.2万起相关投诉及超过8.93亿美元调整后损失,其中60岁以上受害者损失为3.52亿美元。

Aioga 观点

Aioga判断,此案的关键风险不只在于语音合成效果,还在于诈骗者同时利用亲属遇险、限时交款、冒充律师及要求隐瞒用途等手段压缩核验空间。任何仅凭声音确认身份的流程都值得重新审视。

影响与后续

材料显示,部分语音克隆产品主要依赖用户自我声明授权,且若干追踪与识别措施偏向事后溯源。Aioga判断,平台、银行和通信服务若缺少生成前授权核验及转账前独立确认,可能难以及时阻断此类诈骗。 Aioga建议,接到亲属遇险并索要现金的电话时,应先挂断,再通过已知号码直接联系本人或其他亲属核验;不要按来电者要求向银行隐瞒用途。相关平台也值得关注克隆授权验证和生成内容追踪机制。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: 摘要聚合 · 原始域名: smarterarticles.co.uk

来源: Hacker News 热门(buzzing.cc 中文翻译)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-15T16:25:19.955Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

2025年夏季,美国佛罗里达州一名退休老人接到"女儿"哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员--实际上,哭声是从一段音频片段合成的AI语音。FBI...

Hacker News 热门(buzzing.cc 中文翻译)2026-07-15T16:25:19.955Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。