检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。
新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。
検索強化型LLMは消費者向け推薦でGEOコンテンツの汚染の影響を受けやすく、偽製品の無意識の推進者となる可能性がある。新しいベンチマークFORGEは225の実際の製品、15のカテゴリー、5つの消費シナリオで12の商用およびオープンソースLLMをテストし、すべてのモデルが攻撃に弱いことを発見した:単一の汚染ペー...
検索強化型LLMは消費者向け推薦でGEOコンテンツの汚染の影響を受けやすく、偽製品の無意識の推進者となる可能性がある。
オで12の商用およびオープンソースLLMをテストし、すべてのモデルが攻撃に弱いことを発見した:単一の汚染ページで最大27%の騙され率が発生し、最初の3件の結果をすべて置き換えると73.8%に上昇する。
检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。
新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。
HuggingFace Daily Papers收录的FORGE基准显示,检索增强型LLM用于消费推荐时可能受到GEO内容污染影响,并在推荐中无意推广虚假产品。测试覆盖225个真实产品、15个类别、5个消费场景及12个商业和开源LLM。
材料称,FORGE针对消费推荐场景评估检索增强型LLM的脆弱性。结果显示,所有被测试模型均易受攻击;单个污染页面造成的最高受骗率为27%,替换全部前3个结果时升至73.8%。
Aioga判断,这项基准将检索结果污染与LLM推荐风险直接联系起来,说明推荐输出不能只看生成模型本身。具体风险如何随检索策略、产品类别或模型变化,材料尚未说明,值得继续核验。
可能受到影响的不只是搜索排序,也包括依赖检索内容形成推荐的消费决策流程。由于材料未披露攻击页面的具体机制、持续时间或真实业务损失,现阶段更适合将数据视为风险信号,而非普遍损失预测。 建议关注FORGE的完整论文和可复现实验细节,进一步核对污染页面定义、受骗率统计口径及不同模型的分项结果。在相关系统中,可优先审查检索来源和前排结果替换风险,但材料未提供具体防护效果数据。
取得元が提供するタイトル、要約、出典、元記事リンクを掲載しています。記事全文は転載していません。
取得経路: 要約集約 · 元ドメイン: arxiv.org
出典: HuggingFace Daily Papers(社区热门论文)
元記事: 元記事を開く
Aioga アーカイブ: 情報ページを開く
Content record: summary-fallback · Updated: 2026-08-24T00:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga は世界の AI 動向を集約し、確認と引用のため出典情報を保持します。