{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-07-30T04:40:45.661Z","headline":"InMind 基准揭示智能体记忆系统的隐式关联盲点","description":"研究团队发布 InMind 基准，包含 125 个专家验证任务，测试智能体记忆系统处理隐式关联的能力。当关键记忆直接放入上下文时，骨干模型能回答 84.0% 的间接查询；但通过六种记忆系统检索时，命中率最高仅 14.4%，尽管这些系统直接召回准确率可达 100%。失败根源在于查询驱动的检索接口本身，将\"路由--决定哪些事实必须保持可见\"确立为核心开放问题。","url":"https://www.aioga.com/news/cms5hnvv70015ros543ypf7it/","mainEntityOfPage":"https://www.aioga.com/news/cms5hnvv70015ros543ypf7it/","datePublished":"2026-07-27T00:00:00.000Z","dateModified":"2026-07-27T00:00:00.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://arxiv.org/abs/2607.24368","https://aihot.virxact.com/items/cms5hnvv70015ros543ypf7it"],"canonicalUrl":"https://www.aioga.com/news/cms5hnvv70015ros543ypf7it/","directAnswer":{"@type":"Answer","text":"InMind 基准以 125 个专家验证任务评估智能体记忆系统的隐式关联能力。关键记忆直接进入上下文时，骨干模型对间接查询的回答率为 84.0%；经六种记忆系统检索时，最高命中率仅 14.4%。","url":"https://www.aioga.com/news/cms5hnvv70015ros543ypf7it/","dateCreated":"2026-07-27T00:00:00.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"arXiv source article","url":"https://arxiv.org/abs/2607.24368","datePublished":"2026-07-27T00:00:00.000Z","provider":{"@type":"Organization","name":"arXiv","url":"https://arxiv.org/abs/2607.24368"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.virxact.com/items/cms5hnvv70015ros543ypf7it","datePublished":"2026-07-27T00:00:00.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.virxact.com/items/cms5hnvv70015ros543ypf7it"}}],"aggregationSource":"HuggingFace Daily Papers（社区热门论文）","originalPublisher":{"name":"arXiv","url":"https://arxiv.org/abs/2607.24368"},"article":{"id":"cms5hnvv70015ros543ypf7it","slug":"cms5hnvv70015ros543ypf7it","url":"https://www.aioga.com/news/cms5hnvv70015ros543ypf7it/","title":"InMind 基准揭示智能体记忆系统的隐式关联盲点","title_en":"Keep It InMind： Benchmarking the Implicit-Association Blind Spot in Agent Memory","summary":"研究团队发布 InMind 基准，包含 125 个专家验证任务，测试智能体记忆系统处理隐式关联的能力。当关键记忆直接放入上下文时，骨干模型能回答 84.0% 的间接查询；但通过六种记忆系统检索时，命中率最高仅 14.4%，尽管这些系统直接召回准确率可达 100%。失败根源在于查询驱动的检索接口本身，将\"路由--决定哪些事实必须保持可见\"确立为核心开放问题。","source":"HuggingFace Daily Papers（社区热门论文）","sourceUrl":"https://arxiv.org/abs/2607.24368","aiHotUrl":"https://aihot.virxact.com/items/cms5hnvv70015ros543ypf7it","publishedAt":"2026-07-27T00:00:00.000Z","category":"论文研究","score":76,"selected":true,"articleBody":["研究团队发布 InMind 基准，包含 125 个专家验证任务，测试智能体记忆系统处理隐式关联的能力。","当关键记忆直接放入上下文时，骨干模型能回答 84.0% 的间接查询；","但通过六种记忆系统检索时，命中率最高仅 14.4%，尽管这些系统直接召回准确率可达 100%。","失败根源在于查询驱动的检索接口本身，将\"路由--决定哪些事实必须保持可见\"确立为核心开放问题。"],"articleImages":[],"mediaStatus":"none","articleBodyZh":[],"translationStatus":"","bodyOrigin":"summary-fallback","editorial":{"summary":"InMind 基准以 125 个专家验证任务评估智能体记忆系统的隐式关联能力。关键记忆直接进入上下文时，骨干模型对间接查询的回答率为 84.0%；经六种记忆系统检索时，最高命中率仅 14.4%。","background":"材料显示，受测记忆系统的直接召回准确率最高可达 100%，但面对需要隐式关联的间接查询，检索表现明显下降。研究将问题指向查询驱动的检索接口，并提出应关注哪些事实需要持续可见。","viewpoint":"Aioga 判断，这组结果提示：直接召回准确率不足以单独衡量智能体记忆系统的有效性。系统即使能够找到明确相关的信息，也可能无法识别完成间接查询所需的潜在关联。","implications":"该研究可能推动智能体记忆评估从直接匹配扩展到隐式关联与信息路由。值得关注的是，后续系统设计是否会把关键事实的持续可见性纳入检索接口，而非只优化查询与记忆的直接相似关系。","nextStep":"Aioga 判断，下一步应在更多任务中复核 InMind 所揭示的差距，并分别评估骨干模型、记忆检索和路由机制。研究还可围绕“哪些事实必须保持可见”设计对照实验，但材料未提供具体方案。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-07-29T03:03:08.504Z","sourceHash":"049ab46135895bc4","review":{"approved":true,"groundedness":96,"clarity":92,"duplicationRisk":28,"blockingIssues":[],"notes":["核心数据与来源一致：125 个任务、上下文直接提供关键记忆时为 84.0%、六种记忆系统检索时最高仅 14.4%、直接召回准确率可达 100%。","viewpoint、implications 和 nextStep 中的推论或建议使用了“Aioga 判断”“可能”“值得关注”等限定语，没有冒充来源事实。","background 与 summary 对直接召回和间接查询之间差距的表述略有重复，但不影响信息质量。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","low-source-overlap","no-html","independent-ai-review"]}},"tags":["论文研究","HuggingFace Daily Papers（社区热门论文）"],"translations":{"zh-CN":{"title":"InMind 基准揭示智能体记忆系统的隐式关联盲点","summary":"研究团队发布 InMind 基准，包含 125 个专家验证任务，测试智能体记忆系统处理隐式关联的能力。当关键记忆直接放入上下文时，骨干模型能回答 84.0% 的间接查询；但通过六种记忆系统检索时，命中率最高仅 14.4%，尽管这些系统直接召回准确率可达 100%。失败根源在于查询驱动的检索接口本身，将\"路由--决定哪些事实必须保持可见\"确立为核心开放问题。","category":"论文研究","source":"arXiv","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"InMind 基准揭示智能体记忆系统的隐式关联盲点 - Aioga AI资讯","description":"研究团队发布 InMind 基准，包含 125 个专家验证任务，测试智能体记忆系统处理隐式关联的能力。当关键记忆直接放入上下文时，骨干模型能回答 84.0% 的间接查询；但通过六种记忆系统检索时，命中率最高仅 14.4%，尽管这些系统直接召回准确率可达 100%。失败根源在于查询驱动的检索接口本身，将\"路由--决定哪些事实必须保持可见\"确立为核心开放问题。","url":"https://www.aioga.com/news/cms5hnvv70015ros543ypf7it/"},"en":{"title":"The InMind benchmark reveals implicit association blind spots in agent memory systems","summary":"The research team released the InMind benchmark, which includes 125 expert validation tasks to test the agent's memory system's ability to handle implicit associations. When key memories are placed directly in context, the backbone model can answer 84.0% of indirect queries; But when retrieved through six memory systems, the highest hit rate was only 14.4%, although these systems could achieve 100% accuracy in direct recall. The root of failure lies in the query-driven retrieval interface itself, which establishes \"routing—determining which facts must remain visible\" as a core open question.","category":"Research","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"The InMind benchmark reveals implicit association blind spots in agent memory systems - Aioga AI News","description":"The research team released the InMind benchmark, which includes 125 expert validation tasks to test the agent's memory system's ability to handle implicit associations. When key me...","url":"https://www.aioga.com/en/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:23.995Z"},"ja":{"title":"InMindベンチマークはエージェントのメモリシステムにおける暗黙の連想盲点を明らかにします","summary":"研究チームはInMindベンチマークを発表しました。これには、エージェントの記憶システムが暗黙的連想を扱う能力をテストするための125の専門家による検証タスクが含まれています。 キーメモリを直接文脈に置くと、バックボーンモデルは間接クエリの84.0%に答えることができます。 しかし、6つのメモリシステムを通じて取得した場合、最も高い命中率はわずか14.4%でしたが、これらのシステムは直接呼び戻しにおいて100%の精度を達成できました。 失敗の根本はクエリ駆動の検索インターフェース自体にあり、「ルーティング—どの事実が可視化すべきかを判断すること」を未解決の核心課題として確立しています。","category":"論文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"InMindベンチマークはエージェントのメモリシステムにおける暗黙の連想盲点を明らかにします - Aioga AIニュース","description":"研究チームはInMindベンチマークを発表しました。これには、エージェントの記憶システムが暗黙的連想を扱う能力をテストするための125の専門家による検証タスクが含まれています。 キーメモリを直接文脈に置くと、バックボーンモデルは間接クエリの84.0%に答えることができます。 しかし、6つのメモリシステムを通じて取得した場合、最も高い命中率はわずか14.4%で...","url":"https://www.aioga.com/ja/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:24.104Z"},"ko":{"title":"InMind 벤치마크는 에이전트 메모리 시스템에서 암묵적 연관 사각지를 드러냅니다","summary":"연구팀은 InMind 벤치마크를 발표했으며, 여기에는 에이전트의 메모리 시스템이 암묵적 연관을 처리하는 능력을 테스트하기 위한 125개의 전문가 검증 과제가 포함되어 있습니다. 핵심 기억을 맥락 속에 직접 배치할 때, 백본 모델은 간접 쿼리의 84.0%에 답할 수 있습니다; 하지만 6개의 메모리 시스템을 통해 검색했을 때 가장 높은 명중률은 14.4%에 불과했으며, 이 시스템들은 직접 호출에 100% 정확도를 달성할 수 있었습니다. 실패의 근본 원인은 쿼리 기반 검색 인터페이스 자체에 있으며, 이는 \"라우팅—어떤 사실이 가시적으로 유지되어야 하는지 결정하는 것\"을 핵심 미해결 문제로 설정한다.","category":"연구","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"InMind 벤치마크는 에이전트 메모리 시스템에서 암묵적 연관 사각지를 드러냅니다 - Aioga AI 뉴스","description":"연구팀은 InMind 벤치마크를 발표했으며, 여기에는 에이전트의 메모리 시스템이 암묵적 연관을 처리하는 능력을 테스트하기 위한 125개의 전문가 검증 과제가 포함되어 있습니다. 핵심 기억을 맥락 속에 직접 배치할 때, 백본 모델은 간접 쿼리의 84.0%에 답할 수 있습니다; 하지만 6개의 메모리 시스템을 통해 검색했을 때...","url":"https://www.aioga.com/ko/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:32.784Z"},"es":{"title":"El benchmark InMind revela puntos ciegos implícitos de asociación en sistemas de memoria de agentes","summary":"El equipo de investigación publicó el benchmark InMind, que incluye 125 tareas de validación expertas para probar la capacidad del sistema de memoria del agente para manejar asociaciones implícitas. Cuando las memorias clave se colocan directamente en contexto, el modelo de columna vertebral puede responder al 84,0% de las consultas indirectas; Pero al recuperarse a través de seis sistemas de memoria, la tasa de acierto más alta fue solo del 14,4%, aunque estos sistemas podían alcanzar una precisión del 100% en la memoria directa. La raíz del fallo radica en la propia interfaz de recuperación basada en consultas, que establece el \"enrutamiento—determinar qué hechos deben permanecer visibles\" como una cuestión central abierta.","category":"Investigación","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"El benchmark InMind revela puntos ciegos implícitos de asociación en sistemas de memoria de agentes - Aioga Noticias de IA","description":"El equipo de investigación publicó el benchmark InMind, que incluye 125 tareas de validación expertas para probar la capacidad del sistema de memoria del agente para manejar asocia...","url":"https://www.aioga.com/es/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:32.740Z"},"fr":{"title":"Le benchmark InMind révèle des angles morts implicites liés à l’association dans les systèmes de mémoire d’agents","summary":"L’équipe de recherche a publié le benchmark InMind, qui comprend 125 tâches de validation par les experts pour tester la capacité du système mémoire de l’agent à gérer les associations implicites. Lorsque les mémoires clés sont placées directement dans leur contexte, le modèle de la colonne vertébrale peut répondre à 84,0 % des requêtes indirectes ; Mais lorsqu’ils sont récupérés via six systèmes mémoire, le taux de réussite le plus élevé n’était que de 14,4 %, bien que ces systèmes puissent atteindre une précision de 100 % lors du rappel direct. La racine de la défaillance réside dans l’interface de récupération pilotée par requête elle-même, qui établit le « routage — déterminer quels faits doivent rester visibles » comme une question centrale ouverte.","category":"Recherche","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Le benchmark InMind révèle des angles morts implicites liés à l’association dans les systèmes de mémoire d’agents - Aioga Actualités IA","description":"L’équipe de recherche a publié le benchmark InMind, qui comprend 125 tâches de validation par les experts pour tester la capacité du système mémoire de l’agent à gérer les associat...","url":"https://www.aioga.com/fr/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:41.544Z"},"de":{"title":"Der InMind-Benchmark zeigt implizite Assoziationsblindflecken in Agentenspeichersystemen auf","summary":"Das Forschungsteam veröffentlichte den InMind-Benchmark, der 125 Experten-Validierungsaufgaben umfasst, um die Fähigkeit des Speichersystems des Agenten zu testen, implizite Assoziationen zu verarbeiten. Wenn Schlüsselspeicher direkt in den Kontext gesetzt werden, kann das Backbone-Modell 84,0 % der indirekten Anfragen beantworten; Doch wenn sie über sechs Speichersysteme abgerufen wurden, lag die höchste Trefferquote nur bei 14,4 %, obwohl diese Systeme 100 % Genauigkeit im direkten Abruf erreichen konnten. Die Ursache des Fehlers liegt in der fragegesteuerten Abrufschnittstelle selbst, die \"Routing – also die Bestimmung der sichtbaren Fakten\" als zentrale offene Frage etabliert.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Der InMind-Benchmark zeigt implizite Assoziationsblindflecken in Agentenspeichersystemen auf - Aioga KI-News","description":"Das Forschungsteam veröffentlichte den InMind-Benchmark, der 125 Experten-Validierungsaufgaben umfasst, um die Fähigkeit des Speichersystems des Agenten zu testen, implizite Assozi...","url":"https://www.aioga.com/de/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:41.550Z"},"pt-BR":{"title":"O benchmark InMind revela pontos cegos implícitos de associação em sistemas de memória de agentes","summary":"A equipe de pesquisa lançou o benchmark InMind, que inclui 125 tarefas de validação de especialistas para testar a capacidade do sistema de memória do agente de lidar com associações implícitas. Quando memórias-chave são colocadas diretamente no contexto, o modelo backbone pode responder a 84,0% das consultas indiretas; Mas quando recuperado por seis sistemas de memória, a maior taxa de acerto foi de apenas 14,4%, embora esses sistemas pudessem alcançar 100% de precisão em recall direto. A raiz da falha está na própria interface de recuperação orientada por consultas, que estabelece o \"roteamento — determinar quais fatos devem permanecer visíveis\" como uma questão central em aberto.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"O benchmark InMind revela pontos cegos implícitos de associação em sistemas de memória de agentes - Aioga Notícias de IA","description":"A equipe de pesquisa lançou o benchmark InMind, que inclui 125 tarefas de validação de especialistas para testar a capacidade do sistema de memória do agente de lidar com associaçõ...","url":"https://www.aioga.com/pt-BR/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:50.311Z"},"ru":{"title":"Бенчмарк InMind выявляет неявные ассоциационные слепые зоны в системах памяти агентов","summary":"Исследовательская группа выпустила бенчмарк InMind, который включает 125 экспертных валидационных заданий для проверки способности системы памяти агента работать с неявными ассоциациями. Когда ключевые воспоминания помещаются непосредственно в контекст, магистральная модель может ответить на 84,0% косвенных запросов; Однако при извлечении через шесть систем памяти максимальный процент попаданий составлял всего 14,4%, хотя эти системы могли достигать 100% точности при прямом отзыве. Корень неудачи лежит в самом интерфейсе поиска, управляемом запросами, который устанавливает «маршрутизацию — определение, какие факты должны оставаться видимыми» как ключевой открытый вопрос.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Бенчмарк InMind выявляет неявные ассоциационные слепые зоны в системах памяти агентов - Aioga Новости ИИ","description":"Исследовательская группа выпустила бенчмарк InMind, который включает 125 экспертных валидационных заданий для проверки способности системы памяти агента работать с неявными ассоциа...","url":"https://www.aioga.com/ru/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:50.329Z"},"ar":{"title":"يكشف معيار InMind عن نقاط عمياء ضمنية في أنظمة ذاكرة الوكلاء","summary":"أصدر فريق البحث معيار InMind، الذي يتضمن 125 مهمة تحقق خبيرة لاختبار قدرة نظام ذاكرة الوكيل على التعامل مع الارتباطات الضمنية. عندما توضع الذكريات الرئيسية مباشرة في السياق، يمكن لنموذج العمود الفقري الإجابة على 84.0٪ من الاستعلامات غير المباشرة؛ ولكن عند استرجاعها عبر ستة أنظمة ذاكرة، كان أعلى معدل إصابة فقط 14.4٪، رغم أن هذه الأنظمة كانت تحقق دقة 100٪ في الاستدعاء المباشر. يكمن جذر الفشل في واجهة الاسترجاع المدفوعة بالاستعلام نفسها، والتي تؤسس \"التوجيه—تحديد الحقائق التي يجب أن تبقى مرئية\" كسؤال مفتوح أساسي.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"يكشف معيار InMind عن نقاط عمياء ضمنية في أنظمة ذاكرة الوكلاء - Aioga أخبار الذكاء الاصطناعي","description":"أصدر فريق البحث معيار InMind، الذي يتضمن 125 مهمة تحقق خبيرة لاختبار قدرة نظام ذاكرة الوكيل على التعامل مع الارتباطات الضمنية. عندما توضع الذكريات الرئيسية مباشرة في السياق، يمكن ل...","url":"https://www.aioga.com/ar/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:59.038Z"},"hi":{"title":"इनमाइंड बेंचमार्क एजेंट मेमोरी सिस्टम में अंतर्निहित एसोसिएशन ब्लाइंड स्पॉट का खुलासा करता है","summary":"शोध दल ने इनमाइंड बेंचमार्क जारी किया, जिसमें निहित संघों को संभालने के लिए एजेंट की मेमोरी सिस्टम की क्षमता का परीक्षण करने के लिए 125 विशेषज्ञ सत्यापन कार्य शामिल हैं। जब प्रमुख यादों को सीधे संदर्भ में रखा जाता है, तो बैकबोन मॉडल 84.0% अप्रत्यक्ष प्रश्नों का उत्तर दे सकता है; लेकिन जब छह मेमोरी सिस्टम के माध्यम से पुनर्प्राप्त किया गया, तो उच्चतम हिट दर केवल 14.4% थी, हालांकि ये सिस्टम सीधे याद करने में 100% सटीकता प्राप्त कर सकते थे। विफलता की जड़ क्वेरी-संचालित पुनर्प्राप्ति इंटरफ़ेस में ही निहित है, जो एक मुख्य खुले प्रश्न के रूप में \"रूटिंग-यह निर्धारित करना कि कौन से तथ्य दृश्यमान रहने चाहिए\" स्थापित करता है।","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"इनमाइंड बेंचमार्क एजेंट मेमोरी सिस्टम में अंतर्निहित एसोसिएशन ब्लाइंड स्पॉट का खुलासा करता है - Aioga AI समाचार","description":"शोध दल ने इनमाइंड बेंचमार्क जारी किया, जिसमें निहित संघों को संभालने के लिए एजेंट की मेमोरी सिस्टम की क्षमता का परीक्षण करने के लिए 125 विशेषज्ञ सत्यापन कार्य शामिल हैं। जब प्रमुख...","url":"https://www.aioga.com/hi/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:01:59.246Z"},"it":{"title":"Il benchmark InMind rivela punti ciechi impliciti di associazione nei sistemi di memoria degli agenti","summary":"Il team di ricerca ha pubblicato il benchmark InMind, che include 125 compiti di validazione esperti per testare la capacità del sistema di memoria dell'agente di gestire associazioni implicite. Quando le memorie chiave sono inserite direttamente nel contesto, il modello backbone può rispondere all'84,0% delle query indirette; Ma recuperati attraverso sei sistemi di memoria, il tasso di acerto più alto era solo del 14,4%, anche se questi sistemi potevano raggiungere il 100% di accuratezza nel richiamo diretto. La radice del fallimento risiede nell'interfaccia di recupero guidata dalle query stessa, che stabilisce il \"routing—determinare quali fatti devono rimanere visibili\" come una questione fondamentale aperta.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Il benchmark InMind rivela punti ciechi impliciti di associazione nei sistemi di memoria degli agenti - Aioga Notizie IA","description":"Il team di ricerca ha pubblicato il benchmark InMind, che include 125 compiti di validazione esperti per testare la capacità del sistema di memoria dell'agente di gestire associazi...","url":"https://www.aioga.com/it/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:07.961Z"},"nl":{"title":"De InMind-benchmark onthult impliciete blinde vlekken in agentgeheugensystemen","summary":"Het onderzoeksteam bracht de InMind-benchmark uit, die 125 deskundige validatietaken omvat om het vermogen van het geheugensysteem van de agent te testen om impliciete associaties te verwerken. Wanneer sleutelherinneringen direct in context worden geplaatst, kan het backbone-model 84,0% van de indirecte vragen beantwoorden; Maar wanneer ze via zes geheugensystemen werden opgehaald, was de hoogste trefferskans slechts 14,4%, hoewel deze systemen 100% nauwkeurigheid konden bereiken bij directe herinnering. De oorzaak van de storing ligt in de query-gedreven ophaalinterface zelf, die \"routing—bepalen welke feiten zichtbaar moeten blijven\" als een kern open vraag vaststelt.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"De InMind-benchmark onthult impliciete blinde vlekken in agentgeheugensystemen - Aioga AI-nieuws","description":"Het onderzoeksteam bracht de InMind-benchmark uit, die 125 deskundige validatietaken omvat om het vermogen van het geheugensysteem van de agent te testen om impliciete associaties...","url":"https://www.aioga.com/nl/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:07.970Z"},"tr":{"title":"InMind kıyaslası, ajan bellek sistemlerinde örtük ilişki kör noktalarını ortaya koyuyor","summary":"Araştırma ekibi, ajanın bellek sisteminin örtük çağrışımları yönetme yeteneğini test etmek için 125 uzman doğrulama görevini içeren InMind kıyaslamasını yayımladı. Ana hafızalar doğrudan bağlama yerleştirildiğinde, omurga modeli dolaylı soruların %84,0'ını yanıtlayabilir; Ancak altı bellek sisteminden alındığında, en yüksek isabet oranı sadece %14,4 idi, ancak bu sistemler doğrudan geri çağırmada %100 doğruluk sağlayabiliyordu. Başarısızlığın kökü, \"yönlendirme—hangi gerçeklerin görünür kalması gerektiğini belirlemeyi\" temel açık soru olarak belirleyen sorgu odaklı arama arayüzünde yatıyor.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"InMind kıyaslası, ajan bellek sistemlerinde örtük ilişki kör noktalarını ortaya koyuyor - Aioga AI Haberleri","description":"Araştırma ekibi, ajanın bellek sisteminin örtük çağrışımları yönetme yeteneğini test etmek için 125 uzman doğrulama görevini içeren InMind kıyaslamasını yayımladı. Ana hafızalar do...","url":"https://www.aioga.com/tr/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:16.814Z"},"vi":{"title":"Bài kiểm tra InMind tiết lộ các điểm mù liên kết ngầm định trong hệ thống bộ nhớ tác nhân","summary":"Nhóm nghiên cứu đã phát hành chuẩn InMind, bao gồm 125 nhiệm vụ xác thực chuyên gia để kiểm tra khả năng xử lý các liên kết ngầm của hệ thống bộ nhớ của tác nhân. Khi bộ nhớ khóa được đặt trực tiếp trong ngữ cảnh, mô hình xương sống có thể trả lời 84,0% các truy vấn gián tiếp; Nhưng khi được truy xuất qua sáu hệ thống bộ nhớ, tỷ lệ trúng cao nhất chỉ là 14,4%, mặc dù các hệ thống này có thể đạt độ chính xác 100% khi ghi nhớ trực tiếp. Nguyên nhân của thất bại nằm ở chính giao diện truy vấn dựa trên truy vấn, vốn thiết lập \"định tuyến—xác định những sự kiện nào phải được hiển thị\" như một câu hỏi cốt lõi còn bỏ ngỏ.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Bài kiểm tra InMind tiết lộ các điểm mù liên kết ngầm định trong hệ thống bộ nhớ tác nhân - Tin tức AI Aioga","description":"Nhóm nghiên cứu đã phát hành chuẩn InMind, bao gồm 125 nhiệm vụ xác thực chuyên gia để kiểm tra khả năng xử lý các liên kết ngầm của hệ thống bộ nhớ của tác nhân. Khi bộ nhớ khóa đ...","url":"https://www.aioga.com/vi/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:16.748Z"},"id":{"title":"Tolok ukur InMind mengungkapkan titik buta asosiasi implisit dalam sistem memori agen","summary":"Tim riset merilis benchmark InMind, yang mencakup 125 tugas validasi ahli untuk menguji kemampuan sistem memori agen dalam menangani asosiasi implisit. Ketika memori kunci ditempatkan langsung dalam konteks, model tulang punggung dapat menjawab 84,0% kueri tidak langsung; Namun ketika diambil melalui enam sistem memori, tingkat ketepatan tertinggi hanya 14,4%, meskipun sistem ini dapat mencapai akurasi 100% dalam recall langsung. Akar kegagalan terletak pada antarmuka pencarian yang didorong oleh kueri itu sendiri, yang menetapkan \"routing—menentukan fakta mana yang harus tetap terlihat\" sebagai pertanyaan inti yang masih terbuka.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Tolok ukur InMind mengungkapkan titik buta asosiasi implisit dalam sistem memori agen - Berita AI Aioga","description":"Tim riset merilis benchmark InMind, yang mencakup 125 tugas validasi ahli untuk menguji kemampuan sistem memori agen dalam menangani asosiasi implisit. Ketika memori kunci ditempat...","url":"https://www.aioga.com/id/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:25.522Z"},"th":{"title":"การทดสอบ InMind เผยให้เห็นจุดบอดของการเชื่อมโยงโดยนัยในระบบหน่วยความจําของตัวแทน","summary":"ทีมวิจัยได้ปล่อย InMind benchmark ซึ่งประกอบด้วยงานตรวจสอบโดยผู้เชี่ยวชาญ 125 งานเพื่อทดสอบความสามารถของระบบหน่วยความจําของตัวแทนในการจัดการกับการเชื่อมโยงโดยนัย เมื่อหน่วยความจําสําคัญถูกวางตรงในบริบท โมเดลโครงข่ายหลักสามารถตอบคําถามทางอ้อมได้ถึง 84.0%; แต่เมื่อดึงข้อมูลผ่านระบบหน่วยความจําหกระบบ อัตราการยิงโดนสูงสุดอยู่ที่เพียง 14.4% แม้ว่าระบบเหล่านี้จะสามารถเรียกคืนโดยตรงได้แม่นยําถึง 100% รากเหง้าของความล้มเหลวอยู่ที่อินเทอร์เฟซการสืบค้นที่ขับเคลื่อนด้วยคําสั่งค้นหาเอง ซึ่งกําหนด \"การกําหนดเส้นทาง—การกําหนดข้อเท็จจริงใดต้องยังคงมองเห็นได้\" เป็นคําถามเปิดหลัก","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"การทดสอบ InMind เผยให้เห็นจุดบอดของการเชื่อมโยงโดยนัยในระบบหน่วยความจําของตัวแทน - ข่าว AI Aioga","description":"ทีมวิจัยได้ปล่อย InMind benchmark ซึ่งประกอบด้วยงานตรวจสอบโดยผู้เชี่ยวชาญ 125 งานเพื่อทดสอบความสามารถของระบบหน่วยความจําของตัวแทนในการจัดการกับการเชื่อมโยงโดยนัย เมื่อหน่วยความจําส...","url":"https://www.aioga.com/th/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:25.584Z"},"pl":{"title":"Benchmark InMind ujawnia ślepe punkty niejawne powiązania w systemach pamięci agentów","summary":"Zespół badawczy opublikował benchmark InMind, który zawiera 125 zadań walidacyjnych ekspertów mających na celu sprawdzenie zdolności systemu pamięci agenta do radzenia sobie z ukrytymi skojarzeniami. Gdy pamięci kluczy są umieszczone bezpośrednio w kontekście, model szkieletowy może odpowiedzieć na 84,0% zapytań pośrednich; Jednak po uzyskaniu przez sześć systemów pamięci najwyższa skuteczność trafień wynosiła tylko 14,4%, choć systemy te mogły osiągnąć 100% dokładność w bezpośrednim przypomnieniu. Źródłem błędu jest sam interfejs wyszukiwania sterowany zapytaniami, który ustanawia \"routing — określanie, które fakty muszą pozostać widoczne\" jako kluczowe pytanie otwarte.","category":"论文研究","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"Benchmark InMind ujawnia ślepe punkty niejawne powiązania w systemach pamięci agentów - Aioga Wiadomości AI","description":"Zespół badawczy opublikował benchmark InMind, który zawiera 125 zadań walidacyjnych ekspertów mających na celu sprawdzenie zdolności systemu pamięci agenta do radzenia sobie z ukry...","url":"https://www.aioga.com/pl/news/cms5hnvv70015ros543ypf7it/","contentTranslated":true,"sourceHash":"b1bd8d901c89e00c","translatedAt":"2026-07-29T03:02:34.279Z"}}}}