检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。
新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。
Los LLM potenciados con recuperación de información en recomendaciones de consumo son susceptibles a la contaminación de contenido GEO, convirtiéndose en p...
Los LLM potenciados con recuperación de información en recomendaciones de consumo son susceptibles a
la contaminación de contenido GEO, convirtiéndose en promotores involuntarios de productos falsos. El nuevo benchmark FORGE probó 12 LLM comerciales y de código abierto en 225 productos reales, 15 categorías y 5 escenarios de consumo, y descubrió que todos los modelos son vulnerables a ataques: una sola página contaminada puede causar una tasa de engaño de hasta el 27%, y al reemplazar los 3 primeros resultados, esta asciende al 73,8%.
检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。
新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。
HuggingFace Daily Papers收录的FORGE基准显示,检索增强型LLM用于消费推荐时可能受到GEO内容污染影响,并在推荐中无意推广虚假产品。测试覆盖225个真实产品、15个类别、5个消费场景及12个商业和开源LLM。
材料称,FORGE针对消费推荐场景评估检索增强型LLM的脆弱性。结果显示,所有被测试模型均易受攻击;单个污染页面造成的最高受骗率为27%,替换全部前3个结果时升至73.8%。
Aioga判断,这项基准将检索结果污染与LLM推荐风险直接联系起来,说明推荐输出不能只看生成模型本身。具体风险如何随检索策略、产品类别或模型变化,材料尚未说明,值得继续核验。
可能受到影响的不只是搜索排序,也包括依赖检索内容形成推荐的消费决策流程。由于材料未披露攻击页面的具体机制、持续时间或真实业务损失,现阶段更适合将数据视为风险信号,而非普遍损失预测。 建议关注FORGE的完整论文和可复现实验细节,进一步核对污染页面定义、受骗率统计口径及不同模型的分项结果。在相关系统中,可优先审查检索来源和前排结果替换风险,但材料未提供具体防护效果数据。
La fuente proporciona título, resumen, atribución y enlace original. Aioga no republica el artículo completo.
Canal de ingesta: Agregación de resúmenes · Dominio original: arxiv.org
Fuente: HuggingFace Daily Papers(社区热门论文)
Enlace original: Abrir fuente original
Archivo Aioga: Abrir página de inteligencia
Content record: summary-fallback · Updated: 2026-08-24T00:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga agrega novedades globales de IA y conserva las fuentes para verificación y cita.