检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。
新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。
تتعرض نماذج اللغة الكبيرة المعززة بالبحث (LLM) في التوصيات الاستهلاكية بسهولة لتلوث المحتوى الجغرافي (GEO)، مما يجعلها مروجًا غير مقصود للمنتجات الزائفة. ا...
تتعرض نماذج اللغة الكبيرة المعززة بالبحث (LLM) في التوصيات الاستهلاكية بسهولة لتلوث المحتوى الجغرافي
(GEO)، مما يجعلها مروجًا غير مقصود للمنتجات الزائفة. اختبر المعيار الجديد FORGE 12 نموذجًا تجاريًا ومفتوح المصدر على 225 منتجًا حقيقيًا و15 فئة و5 سيناريوهات استهلاكية، ووجد أن جميع النماذج سهلة التعرض للهجوم: يمكن لصفحة ملوثة واحدة أن تسبب معدل خديعة يصل إلى 27٪، وعند استبدال الثلاث نتائج الأولى كلها يرتفع إلى 73.8٪.
检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。
新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。
HuggingFace Daily Papers收录的FORGE基准显示,检索增强型LLM用于消费推荐时可能受到GEO内容污染影响,并在推荐中无意推广虚假产品。测试覆盖225个真实产品、15个类别、5个消费场景及12个商业和开源LLM。
材料称,FORGE针对消费推荐场景评估检索增强型LLM的脆弱性。结果显示,所有被测试模型均易受攻击;单个污染页面造成的最高受骗率为27%,替换全部前3个结果时升至73.8%。
Aioga判断,这项基准将检索结果污染与LLM推荐风险直接联系起来,说明推荐输出不能只看生成模型本身。具体风险如何随检索策略、产品类别或模型变化,材料尚未说明,值得继续核验。
可能受到影响的不只是搜索排序,也包括依赖检索内容形成推荐的消费决策流程。由于材料未披露攻击页面的具体机制、持续时间或真实业务损失,现阶段更适合将数据视为风险信号,而非普遍损失预测。 建议关注FORGE的完整论文和可复现实验细节,进一步核对污染页面定义、受骗率统计口径及不同模型的分项结果。在相关系统中,可优先审查检索来源和前排结果替换风险,但材料未提供具体防护效果数据。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: arxiv.org
المصدر: HuggingFace Daily Papers(社区热门论文)
原文链接: فتح المصدر الأصلي
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-08-24T00:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。