{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-09-28T06:03:00.468Z","headline":"小米公开 MiMo-V3 核心架构 HySparse2：面向长程多轮 Agent 优化推理效率","description":"小米公开面向 MiMo-V3 的核心架构 HySparse2，通过两级 KV 共享与 token 级稀疏选择优化长上下文 Agent 推理。","url":"https://www.aioga.com/news/cmuf9rxjt06cnrocs35twhqm2/","mainEntityOfPage":"https://www.aioga.com/news/cmuf9rxjt06cnrocs35twhqm2/","datePublished":"2026-09-24T08:28:04.000Z","dateModified":"2026-09-24T08:28:04.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://www.ithome.com/1/006/839.htm","https://aihot.news/items/cmuf9rxjt06cnrocs35twhqm2"],"canonicalUrl":"https://www.aioga.com/news/cmuf9rxjt06cnrocs35twhqm2/","directAnswer":{"@type":"Answer","text":"小米公开面向 MiMo-V3 的核心架构 HySparse2，针对长程多轮 Agent 场景，引入两级 KV 共享、token 级稀疏选择和统一的局部信息访问方式，以减少 Prefill 计算、缩小 KV Cache，并提升长上下文信息检索效率。","url":"https://www.aioga.com/news/cmuf9rxjt06cnrocs35twhqm2/","dateCreated":"2026-09-24T08:28:04.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"IT之家 source article","url":"https://www.ithome.com/1/006/839.htm","datePublished":"2026-09-24T08:28:04.000Z","provider":{"@type":"Organization","name":"IT之家","url":"https://www.ithome.com/1/006/839.htm"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.news/items/cmuf9rxjt06cnrocs35twhqm2","datePublished":"2026-09-24T08:28:04.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.news/items/cmuf9rxjt06cnrocs35twhqm2"}}],"aggregationSource":"IT之家（RSS）","originalPublisher":{"name":"IT之家","url":"https://www.ithome.com/1/006/839.htm"},"geoDeepAnswer":null,"article":{"id":"cmuf9rxjt06cnrocs35twhqm2","slug":"cmuf9rxjt06cnrocs35twhqm2","url":"https://www.aioga.com/news/cmuf9rxjt06cnrocs35twhqm2/","title":"小米公开 MiMo-V3 核心架构 HySparse2：面向长程多轮 Agent 优化推理效率","title_en":"","summary":"小米公开面向 MiMo-V3 的核心架构 HySparse2，通过两级 KV 共享与 token 级稀疏选择优化长上下文 Agent 推理。","source":"IT之家（RSS）","sourceUrl":"https://www.ithome.com/1/006/839.htm","aiHotUrl":"https://aihot.news/items/cmuf9rxjt06cnrocs35twhqm2","publishedAt":"2026-09-24T08:28:04.000Z","category":"行业动态","score":58,"selected":false,"articleBody":["IT之家：https://www.ithome.com/ 9 月 24 日消息，小米 MiMo 今天公布面向 MiMo-V3 的核心架构 HySparse2，瞄准下一代长上下文 Agent。新架构旨在让模型以更低成本处理网页、文件、代码和工具调用记录，并从不断增长的任务历史中更准确地检索关键信息。","HySparse2 面向长程多轮 AGENT，更少的 Prefill 计算，更小的 KV Cache，更精准的长上下文检索。","从 Xiaomi MiMo-V2 系列开始，我们持续探索模型能力与计算效率的共同提升。MiMo-V2 系列采用的 Hybrid SWA 混合注意力架构，将全注意力（Full Attention）与滑动窗口注意力（Sliding Window Attention）结合，在保持模型效果的同时，让训练和推理更加高效。","过去半年，我们持续推进强化学习（RL）技术的探索与试验，将积累的训练经验应用于近期发布的 MiMo-V2.6 系列，推动模型能力显著提升。在持续推进 V2 系列的同时，面向 MiMo-V3 的新一代架构研究也一直在进行。此前公开的 HySparse，正是这条探索路线上的第一步。","今天， 我们公开 MiMo-V3 的核心架构 HySparse2 。在 HySparse 的基础上，它进一步升级了 KV 共享与稀疏选择机制，让模型更高效更精准地处理长上下文。","一次简短的工具调用，可能带回一整页网页、一份文件，或长长的执行日志。Agent 每向前一步，都要处理新的输入；随着任务推进，还要从不断增长的历史中，找准下一步需要的信息。","模型会把已读内容的表示保存在 KV Cache 中，供后续生成使用。读入新增内容并建立这些缓存的过程，称为 Prefill。在多轮 Agent 任务中，每次工具返回新信息，都需要再次处理新增输入。因此，新架构需要同时满足三个要求。","第一代 HySparse 已经迈出了一步。它用少量 Full Attention 层提供 KV Cache 和重要位置的选择结果，让后续 Sparse Attention 层直接复用，从而降低注意力计算与缓存开销。但在 HySparse 架构中，Prefill 仍然需要执行所有层；面对多轮、长距离的信息检索，块级选择也有进一步提升精度的空间。HySparse2 围绕这些问题，引入了两级 KV 共享、token 级稀疏选择，以及统一的局部信息访问方式。","借鉴 YOCO 的设计，HySparse2 将模型分成前后两部分。前半部分是 Self-Decoder，采用 Full Attention 与 SWA 的混合结构；后半部分是 Cross-Decoder，采用 Full Attention 与 Sparse Attention 的混合结构。","在这个基础上，KV 共享分为两个层次：KV Bridging 和 KV Reuse。","后半部分的每个 Full Attention 层，都从前半部分对应 Full Attention 层的输入隐藏状态中，生成自己的 KV Cache。每个目标层保留独立的 K/V 投影，因此即使使用同一份源隐藏状态，也可以构建不同的 KV。","这样，后半部分 Full Attention 层的 KV 就不必等到输入逐层经过它们后才能得到。生成这些缓存所需的信息，在前半部分就已经具备。","KV Reuse：在同一 Hybrid Block 内，复用 KV 与选择结果","每个 Hybrid Block 由一层 Full Attention 和随后的多层 Sparse Attention 组成。Full Attention 在完成自身计算时，也根据注意力分数选出重要位置；后续稀疏层直接复用它的 KV Cache 和选择索引。","这保留了 HySparse 的核心设计：少量全注意力层提供全局信息与选择结果，多层稀疏注意力高效使用这些信息，无需额外训练一个独立的选择器。","第一代 HySparse 采用块级稀疏选择。在长上下文中，为了选中一个重要 token，模型往往也会把它周围的一整块内容纳入计算。Agent 所需的线索可能分散在不同轮次的对话、工具结果和代码片段中。HySparse2 改为 token 级选择，让同样的注意力预算可以更精细地分配到这些位置。在相同全局 token 预算下，Token 级选择在 RULER-v2、多轮检索 MRCR-v2 和图推理 GraphWalks 上均获得提升，验证了更细粒度选择对这类任务的价值。","全局检索之外，模型仍然需要稳定地看到最近的上下文。HySparse2 会强制选中最近的 128 个 token，再从窗口外选择 1,024 个全局 token。两部分共同读取 Full Attention 层提供的共享 KV Cache。","因此，稀疏层不再需要单独的 SWA 分支和局部 KV Cache。HySparse 中由独立分支承担的局部信息访问，在 HySparse2 中被合并到同一次稀疏注意力计算里。","这也解除了一项关键依赖：独立 SWA 分支的缓存原本来自该层自己的隐藏状态，构建它需要继续执行后半部分 Cross-Decoder 的计算。合并后，局部与全局信息都能使用在 Self-Decoder 阶段就已准备好的 KV。","局部信息仍然重要。HySparse2 的消融实验显示，强制局部窗口在多项长文任务上保持竞争力，部分指标也存在取舍；这一设计同时省去了独立 SWA 分支的投影参数与 KV Cache 开销，为 Prefill 提前退出创造了条件。","两级 KV 共享与局部窗口的合并，使模型后半部分所需的全部 KV Cache 都能从前半部分的隐藏状态构建。完成 Self-Decoder 的计算和 KV Bridging 投影后，输入的 KV Cache 构建即可结束。","在 49 层的模型中，Prefill 只需执行前 25 层 Self-Decoder 以及桥接 KV 投影，其中只有一层 Full Attention。在 Prefill–Decode 分离部署时，Prefill 节点也只需部署这部分 Self-Decoder 网络，所需的模型权重存储接近减半。","这使优化从减少注意力计算，进一步延伸到缩短长输入经过模型的计算路径。生成阶段仍然保留完整网络，继续使用后半部分的全局检索与建模能力。","我们在 80B-A3B MoE 模型上，使用相同的数据与训练流程，对比了 Hybrid SWA、HySparse 和 HySparse2。三者采用相同的 MoE 设计，不同的注意力设计，HySparse2 还使用了更紧凑的 MQA 配置。","在百万 token 的成本分析中，相对 Hybrid SWA，HySparse2 的 Prefill 计算量降至 1/5，KV Cache 从 12GB 降至 2.7 GB。相对第一代 HySparse，HySparse2 的 Prefill 计算量降至 1/3，KV Cache 从 6.7 GB 降至 2.7 GB。","预训练后，HySparse2 保持了大体相当的通用能力，长上下文表现更好。经过相同的轻量后训练后，在最高 256k 的评测范围内，HySparse2 在各项已测长度上都获得了更高的 MRCR-v2、RULER-v2 分数，以及更低的 AgentPPL、LongPPL。前两项考察长上下文中的检索与问答；后两项衡量模型对多轮 Agent 轨迹和依赖远距离信息的 token 的预测能力。相对第一代 HySparse，MRCR-v2 和 RULER-v2 在各报告长度上的平均分分别提高了 11.30 和 19.81 个百分点。","这些结果表明，更少的 KV Cache 与更短的 Prefill，可以与更好的长文检索共同实现。HySparse2 为多轮、长上下文 Agent 提供了更高效的架构基础。","Agent 完成一项任务，需要不断读入信息、生成行动，再根据返回的结果继续推进。每一轮的效率，都影响着用户最终需要等待多久。","此前，MiMo-UltraSpeed 通过模型与系统协同设计，采用了低比特量化，投机解码，MegaKernel 等技术，探索更快的 Decode；今天，HySparse2 进一步降低长上下文的 Prefill 与缓存开销。两项工作分别从输入处理和输出生成入手，推动模型更高效地完成任务。","面向 MiMo-V3，我们希望把这些探索结合起来，在持续提升模型智能的同时，为用户带来同等模型规模下更快的 Prefill 和 Decode，帮助用户更快地完成更复杂的任务。"],"articleImages":[{"sourceUrl":"https://img.ithome.com/newsuploadfiles/2026/9/5a1f2283-7c46-4ea0-a267-e4075e1eb55a.png?x-bce-process=image/format,f_auto","alt":"图片","afterParagraph":9,"url":"/media/articles/cmuf9rxjt06cnrocs35twhqm2/966b58bfaafba3ea.webp"},{"sourceUrl":"https://img.ithome.com/newsuploadfiles/2026/9/3b2847d8-2397-4b31-a427-3b9a54761ab5.png?x-bce-process=image/format,f_auto","alt":"图片","afterParagraph":22,"url":"/media/articles/cmuf9rxjt06cnrocs35twhqm2/7016dfa122252b77.png"},{"sourceUrl":"https://img.ithome.com/newsuploadfiles/2026/9/b1f57b0a-e286-41ac-b5d8-720095d2cd4f.png?x-bce-process=image/format,f_auto","alt":"","afterParagraph":29,"url":"/media/articles/cmuf9rxjt06cnrocs35twhqm2/7094acd462e66f87.png"}],"mediaStatus":"ok","articleBodyZh":["小米公开 MiMo-V3 核心架构 HySparse2：面向长程多轮 Agent 优化推理效率 这条更新来自 ithome.com，发布时间为 2026-09-24，Aioga 保留原文入口以便核验。","摘要：小米公开面向 MiMo-V3 的核心架构 HySparse2，通过两级 KV 共享与 token 级稀疏选择优化长上下文 Agent 推理。","背景：来源介绍称，MiMo-V2 系列采用 Hybrid SWA 混合注意力架构，将全注意力与滑动窗口注意力结合。此前公开的第一代 HySparse 使用少量 Full Attention 层提供 KV Cache 和重要位置选择结果，供后续 Sparse Attention 层复用，但 Prefill 仍需执行所有层，块级选择在长距离检索场景仍有提升空间。","Aioga 观察：Aioga 判断：HySparse2 的公开信息显示，小米正沿着减少长上下文处理开销、提高历史信息选择精度的方向推进 MiMo-V3 架构研究。现有材料主要说明架构设计目标与机制，尚不足以判断其实际性能、成本改善幅度或产品化进展。","影响与后续：可能影响：如果相关机制能够达到公开目标，长程多轮 Agent 的推理资源使用可能获得优化；但材料未提供具体评测数据、对比基线或适用范围，因此不代表实际效果已经得到验证，也不足以据此判断用户体验或商业影响。 后续观察：应关注小米是否公布 HySparse2 的技术论文、实验数据、模型发布计划及与第一代 HySparse或其他架构的可比评测，并核实两级 KV 共享和 token 级稀疏选择在不同长上下文任务中的表现。"],"translationStatus":"","bodyOrigin":"source-page","editorial":{"summary":"小米公开面向 MiMo-V3 的核心架构 HySparse2，针对长程多轮 Agent 场景，引入两级 KV 共享、token 级稀疏选择和统一的局部信息访问方式，以减少 Prefill 计算、缩小 KV Cache，并提升长上下文信息检索效率。","background":"来源介绍称，MiMo-V2 系列采用 Hybrid SWA 混合注意力架构，将全注意力与滑动窗口注意力结合。此前公开的第一代 HySparse 使用少量 Full Attention 层提供 KV Cache 和重要位置选择结果，供后续 Sparse Attention 层复用，但 Prefill 仍需执行所有层，块级选择在长距离检索场景仍有提升空间。","viewpoint":"Aioga 判断：HySparse2 的公开信息显示，小米正沿着减少长上下文处理开销、提高历史信息选择精度的方向推进 MiMo-V3 架构研究。现有材料主要说明架构设计目标与机制，尚不足以判断其实际性能、成本改善幅度或产品化进展。","implications":"可能影响：如果相关机制能够达到公开目标，长程多轮 Agent 的推理资源使用可能获得优化；但材料未提供具体评测数据、对比基线或适用范围，因此不代表实际效果已经得到验证，也不足以据此判断用户体验或商业影响。","nextStep":"后续观察：应关注小米是否公布 HySparse2 的技术论文、实验数据、模型发布计划及与第一代 HySparse或其他架构的可比评测，并核实两级 KV 共享和 token 级稀疏选择在不同长上下文任务中的表现。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-09-24T09:19:52.256Z","sourceHash":"ca8c3c139b6e09e9","review":{"approved":true,"groundedness":96,"clarity":92,"duplicationRisk":30,"blockingIssues":[],"notes":["关于减少 Prefill 计算、缩小 KV Cache 和提升检索效率的表述与来源所述架构目标一致；候选内容也明确指出实际效果尚未得到验证。","summary 与 background 对架构机制有少量信息重叠，但未达到影响审核通过的程度。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","editorial-labels","inference-boundary","low-source-overlap","no-html","independent-ai-review"]}},"tags":["行业动态","IT之家（RSS）"],"translations":{"zh-CN":{"title":"小米公开 MiMo-V3 核心架构 HySparse2：面向长程多轮 Agent 优化推理效率","summary":"小米公开面向 MiMo-V3 的核心架构 HySparse2，通过两级 KV 共享与 token 级稀疏选择优化长上下文 Agent 推理。","category":"行业动态","source":"IT之家","aggregationSource":"IT之家（RSS）","pageTitle":"小米公开 MiMo-V3 核心架构 HySparse2：面向长程多轮 Agent 优化推理效率 - Aioga AI资讯","description":"小米公开面向 MiMo-V3 的核心架构 HySparse2，通过两级 KV 共享与 token 级稀疏选择优化长上下文 Agent 推理。","url":"https://www.aioga.com/news/cmuf9rxjt06cnrocs35twhqm2/","articleBody":["小米公开 MiMo-V3 核心架构 HySparse2：面向长程多轮 Agent 优化推理效率 这条更新来自 ithome.com，发布时间为 2026-09-24，Aioga 保留原文入口以便核验。","摘要：小米公开面向 MiMo-V3 的核心架构 HySparse2，通过两级 KV 共享与 token 级稀疏选择优化长上下文 Agent 推理。","背景：来源介绍称，MiMo-V2 系列采用 Hybrid SWA 混合注意力架构，将全注意力与滑动窗口注意力结合。此前公开的第一代 HySparse 使用少量 Full Attention 层提供 KV Cache 和重要位置选择结果，供后续 Sparse Attention 层复用，但 Prefill 仍需执行所有层，块级选择在长距离检索场景仍有提升空间。","Aioga 观察：Aioga 判断：HySparse2 的公开信息显示，小米正沿着减少长上下文处理开销、提高历史信息选择精度的方向推进 MiMo-V3 架构研究。现有材料主要说明架构设计目标与机制，尚不足以判断其实际性能、成本改善幅度或产品化进展。","影响与后续：可能影响：如果相关机制能够达到公开目标，长程多轮 Agent 的推理资源使用可能获得优化；但材料未提供具体评测数据、对比基线或适用范围，因此不代表实际效果已经得到验证，也不足以据此判断用户体验或商业影响。 后续观察：应关注小米是否公布 HySparse2 的技术论文、实验数据、模型发布计划及与第一代 HySparse或其他架构的可比评测，并核实两级 KV 共享和 token 级稀疏选择在不同长上下文任务中的表现。"]},"en":{"title":"Xiaomi unveils MiMo-V3 core architecture HySparse2: Optimizing inference efficiency for long-range multi-turn agents","summary":"Xiaomi has publicly released the core architecture HySparse2 for MiMo-V3, optimizing long-context Agent reasoning through two-level KV sharing and token-level sparse selection.","category":"Industry","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi unveils MiMo-V3 core architecture HySparse2: Optimizing inference efficiency for long-range multi-turn agents - Aioga AI News","description":"Xiaomi has publicly released the core architecture HySparse2 for MiMo-V3, optimizing long-context Agent reasoning through two-level KV sharing and token-level sparse selection.","url":"https://www.aioga.com/en/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:03:53.933Z"},"ja":{"title":"Xiaomi、MiMo-V3 コアアーキテクチャ HySparse2 を公開：長距離マルチターンエージェント向けに推論効率を最適化","summary":"XiaomiはMiMo-V3向けのコアアーキテクチャHySparse2を公開し、2段階のKV共有とトークンレベルの疎選択を通じて長文コンテキストのエージェント推論を最適化します。","category":"業界動向","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi、MiMo-V3 コアアーキテクチャ HySparse2 を公開：長距離マルチターンエージェント向けに推論効率を最適化 - Aioga AIニュース","description":"XiaomiはMiMo-V3向けのコアアーキテクチャHySparse2を公開し、2段階のKV共有とトークンレベルの疎選択を通じて長文コンテキストのエージェント推論を最適化します。","url":"https://www.aioga.com/ja/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:04:14.180Z"},"ko":{"title":"샤오미, MiMo-V3 핵심 아키텍처 HySparse2 공개: 장거리 다회 에이전트 최적화 추론 효율 지향","summary":"샤오미는 MiMo-V3를 위한 핵심 아키텍처 HySparse2를 공개했으며, 두 단계 KV 공유와 토큰 수준 희소 선택을 통해 장기 컨텍스트 에이전트 추론을 최적화합니다.","category":"업계 동향","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"샤오미, MiMo-V3 핵심 아키텍처 HySparse2 공개: 장거리 다회 에이전트 최적화 추론 효율 지향 - Aioga AI 뉴스","description":"샤오미는 MiMo-V3를 위한 핵심 아키텍처 HySparse2를 공개했으며, 두 단계 KV 공유와 토큰 수준 희소 선택을 통해 장기 컨텍스트 에이전트 추론을 최적화합니다.","url":"https://www.aioga.com/ko/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:05:06.426Z"},"es":{"title":"Xiaomi revela la arquitectura central MiMo-V3 HySparse2: optimización de la eficiencia de razonamiento para agentes de múltiples rondas a largo plazo","summary":"Xiaomi ha hecho público el núcleo de arquitectura HySparse2 para MiMo-V3, optimizando la inferencia de agentes de contexto largo mediante selección dispersa a nivel de token y compartición KV en dos niveles.","category":"Industria","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi revela la arquitectura central MiMo-V3 HySparse2: optimización de la eficiencia de razonamiento para agentes de múltiples rondas a largo plazo - Aioga Noticias de IA","description":"Xiaomi ha hecho público el núcleo de arquitectura HySparse2 para MiMo-V3, optimizando la inferencia de agentes de contexto largo mediante selección dispersa a nivel de token y comp...","url":"https://www.aioga.com/es/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:05:02.278Z"},"fr":{"title":"Xiaomi dévoile l'architecture centrale MiMo-V3 HySparse2 : optimisation de l'efficacité du raisonnement pour les agents multi-tours de longue portée","summary":"Xiaomi a rendu public l'architecture centrale HySparse2 pour MiMo-V3, optimisant le raisonnement des agents sur de longs contextes grâce à un partage KV en deux niveaux et une sélection parcimonieuse au niveau des tokens.","category":"Industrie","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi dévoile l'architecture centrale MiMo-V3 HySparse2 : optimisation de l'efficacité du raisonnement pour les agents multi-tours de longue portée - Aioga Actualités IA","description":"Xiaomi a rendu public l'architecture centrale HySparse2 pour MiMo-V3, optimisant le raisonnement des agents sur de longs contextes grâce à un partage KV en deux niveaux et une séle...","url":"https://www.aioga.com/fr/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:05:57.190Z"},"de":{"title":"Xiaomi veröffentlicht MiMo-V3 Kernarchitektur HySparse2: Optimierung der Inferenz-Effizienz für mehrstufige Agenten über lange Distanzen","summary":"Xiaomi hat die Kernarchitektur HySparse2 für MiMo-V3 öffentlich vorgestellt, die durch zweistufige KV-Freigabe und tokenbasierte Sparse-Auswahl die Inferenz von langem Kontext für Agenten optimiert.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi veröffentlicht MiMo-V3 Kernarchitektur HySparse2: Optimierung der Inferenz-Effizienz für mehrstufige Agenten über lange Distanzen - Aioga KI-News","description":"Xiaomi hat die Kernarchitektur HySparse2 für MiMo-V3 öffentlich vorgestellt, die durch zweistufige KV-Freigabe und tokenbasierte Sparse-Auswahl die Inferenz von langem Kontext für...","url":"https://www.aioga.com/de/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:05:55.520Z"},"pt-BR":{"title":"Xiaomi divulga a arquitetura central MiMo-V3 HySparse2: otimização da eficiência de inferência para agentes de múltiplas rodadas de longo alcance","summary":"Xiaomi publicou a arquitetura central HySparse2 voltada para o MiMo-V3, otimizando a inferência de agente de contexto longo por meio de compartilhamento KV em dois níveis e seleção esparsa a nível de token.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi divulga a arquitetura central MiMo-V3 HySparse2: otimização da eficiência de inferência para agentes de múltiplas rodadas de longo alcance - Aioga Notícias de IA","description":"Xiaomi publicou a arquitetura central HySparse2 voltada para o MiMo-V3, otimizando a inferência de agente de contexto longo por meio de compartilhamento KV em dois níveis e seleção...","url":"https://www.aioga.com/pt-BR/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:06:44.235Z"},"ru":{"title":"Xiaomi представила основную архитектуру MiMo-V3 HySparse2: оптимизация эффективности рассуждений для многократных агентов на дальнем расстоянии","summary":"Xiaomi публично представила ядро архитектуры HySparse2 для MiMo-V3, оптимизирующее вывод длинного контекста агентов через двухуровневое KV-совместное использование и выборку разреженных токенов.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi представила основную архитектуру MiMo-V3 HySparse2: оптимизация эффективности рассуждений для многократных агентов на дальнем расстоянии - Aioga Новости ИИ","description":"Xiaomi публично представила ядро архитектуры HySparse2 для MiMo-V3, оптимизирующее вывод длинного контекста агентов через двухуровневое KV-совместное использование и выборку разреж...","url":"https://www.aioga.com/ru/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:06:47.801Z"},"ar":{"title":"شاومي تكشف عن بنية MiMo-V3 الأساسية HySparse2: مخصصة لتحسين كفاءة الاستدلال لوكلاء متعددين طويل المدى","summary":"كشفت شاومي عن البنية الأساسية HySparse2 الخاصة بـ MiMo-V3، والتي تعمل على تحسين الاستدلال الطويل لسياق العميل من خلال المشاركة الثنائية المستوى للـ KV والاختيار النادر على مستوى الرموز.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"شاومي تكشف عن بنية MiMo-V3 الأساسية HySparse2: مخصصة لتحسين كفاءة الاستدلال لوكلاء متعددين طويل المدى - Aioga أخبار الذكاء الاصطناعي","description":"كشفت شاومي عن البنية الأساسية HySparse2 الخاصة بـ MiMo-V3، والتي تعمل على تحسين الاستدلال الطويل لسياق العميل من خلال المشاركة الثنائية المستوى للـ KV والاختيار النادر على مستوى ال...","url":"https://www.aioga.com/ar/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:07:41.663Z"},"hi":{"title":"शाओमी ने MiMo-V3 कोर आर्किटेक्चर HySparse2 को सार्वजनिक किया: लंबी दूरी के मल्टी-राउंड एजेंट के लिए इंटेलिजेंस ऑप्टिमाइजेशन दक्षता के उद्देश्य से","summary":"Xiaomi ने MiMo-V3 के लिए मुख्य वास्तुकला HySparse2 को सार्वजनिक किया, जो दो-स्तरीय KV साझाकरण और टोकन स्तर की विरलता चयन के माध्यम से लंबी संदर्भ एजेंट तर्क को अनुकूलित करता है।","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"शाओमी ने MiMo-V3 कोर आर्किटेक्चर HySparse2 को सार्वजनिक किया: लंबी दूरी के मल्टी-राउंड एजेंट के लिए इंटेलिजेंस ऑप्टिमाइजेशन दक्षता के उद्देश्य से - Aioga AI समाचार","description":"Xiaomi ने MiMo-V3 के लिए मुख्य वास्तुकला HySparse2 को सार्वजनिक किया, जो दो-स्तरीय KV साझाकरण और टोकन स्तर की विरलता चयन के माध्यम से लंबी संदर्भ एजेंट तर्क को अनुकूलित करता है।","url":"https://www.aioga.com/hi/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:07:39.952Z"},"it":{"title":"Xiaomi svela l'architettura core MiMo-V3 HySparse2: ottimizzazione dell'efficienza di ragionamento per agent multi-turn a lungo raggio","summary":"Xiaomi ha reso pubblico l'architettura core HySparse2 per MiMo-V3, ottimizzando il ragionamento degli agenti con contesto lungo attraverso la condivisione KV a due livelli e la selezione sparsa a livello di token.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi svela l'architettura core MiMo-V3 HySparse2: ottimizzazione dell'efficienza di ragionamento per agent multi-turn a lungo raggio - Aioga Notizie IA","description":"Xiaomi ha reso pubblico l'architettura core HySparse2 per MiMo-V3, ottimizzando il ragionamento degli agenti con contesto lungo attraverso la condivisione KV a due livelli e la sel...","url":"https://www.aioga.com/it/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:08:32.788Z"},"nl":{"title":"Xiaomi maakt MiMo-V3 kernarchitectuur HySparse2 openbaar: gericht op het optimaliseren van de redeneerefficiëntie van langeafstand multi-ronde agenten","summary":"Xiaomi heeft de kernarchitectuur HySparse2 voor MiMo-V3 openbaar gemaakt, die lange context-agentinferentie optimaliseert via tweefasige KV-sharing en token-niveau sparseselectie.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi maakt MiMo-V3 kernarchitectuur HySparse2 openbaar: gericht op het optimaliseren van de redeneerefficiëntie van langeafstand multi-ronde agenten - Aioga AI-nieuws","description":"Xiaomi heeft de kernarchitectuur HySparse2 voor MiMo-V3 openbaar gemaakt, die lange context-agentinferentie optimaliseert via tweefasige KV-sharing en token-niveau sparseselectie.","url":"https://www.aioga.com/nl/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:08:25.167Z"},"tr":{"title":"Xiaomi MiMo-V3 Çekirdek Mimarisi HySparse2'yi Açıklandı: Uzun Menzilli Çok Turlu Ajan Odaklı Çıkarım Verimliliğini Optimize Etme","summary":"Xiaomi, MiMo-V3 için çekirdek mimari HySparse2'yi açıkladı; uzun bağlamlı Agent akıl yürütmesini, iki aşamalı KV paylaşımı ve token seviyesi seyrek seçimle optimize ediyor.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi MiMo-V3 Çekirdek Mimarisi HySparse2'yi Açıklandı: Uzun Menzilli Çok Turlu Ajan Odaklı Çıkarım Verimliliğini Optimize Etme - Aioga AI Haberleri","description":"Xiaomi, MiMo-V3 için çekirdek mimari HySparse2'yi açıkladı; uzun bağlamlı Agent akıl yürütmesini, iki aşamalı KV paylaşımı ve token seviyesi seyrek seçimle optimize ediyor.","url":"https://www.aioga.com/tr/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:09:23.469Z"},"vi":{"title":"Xiaomi công bố kiến trúc lõi MiMo-V3 HySparse2: Tối ưu hóa hiệu quả suy luận cho Agent đa vòng tầm xa","summary":"Xiaomi công khai kiến trúc lõi HySparse2 dành cho MiMo-V3, tối ưu hóa suy luận Agent trong bối cảnh dài thông qua chia sẻ KV hai cấp và chọn lọc thưa ở cấp token.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi công bố kiến trúc lõi MiMo-V3 HySparse2: Tối ưu hóa hiệu quả suy luận cho Agent đa vòng tầm xa - Tin tức AI Aioga","description":"Xiaomi công khai kiến trúc lõi HySparse2 dành cho MiMo-V3, tối ưu hóa suy luận Agent trong bối cảnh dài thông qua chia sẻ KV hai cấp và chọn lọc thưa ở cấp token.","url":"https://www.aioga.com/vi/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:09:22.666Z"},"id":{"title":"Xiaomi membuka arsitektur inti MiMo-V3 HySparse2: Mengoptimalkan efisiensi inferensi untuk agen multi-ronde jarak jauh","summary":"Xiaomi membuka arsitektur inti HySparse2 untuk MiMo-V3, yang mengoptimalkan inferensi agen konteks panjang melalui berbagi KV dua tingkat dan pemilihan jarang tingkat token.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi membuka arsitektur inti MiMo-V3 HySparse2: Mengoptimalkan efisiensi inferensi untuk agen multi-ronde jarak jauh - Berita AI Aioga","description":"Xiaomi membuka arsitektur inti HySparse2 untuk MiMo-V3, yang mengoptimalkan inferensi agen konteks panjang melalui berbagi KV dua tingkat dan pemilihan jarang tingkat token.","url":"https://www.aioga.com/id/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:10:10.168Z"},"th":{"title":"เสี่ยวหมี่เปิดสถาปัตยกรรมหลัก MiMo-V3 HySparse2: มุ่งเน้นการเพิ่มประสิทธิภาพการสืบสอนของเอเจนต์หลายรอบระยะไกล","summary":"Xiaomi เผยโครงสร้างหลัก HySparse2 สำหรับ MiMo-V3 โดยผ่านการแชร์ KV สองขั้นและการเลือกความหายากระดับโทเค็น เพื่อปรับปรุงการอนุมานของ Agent ในบริบทยาว","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"เสี่ยวหมี่เปิดสถาปัตยกรรมหลัก MiMo-V3 HySparse2: มุ่งเน้นการเพิ่มประสิทธิภาพการสืบสอนของเอเจนต์หลายรอบระยะไกล - ข่าว AI Aioga","description":"Xiaomi เผยโครงสร้างหลัก HySparse2 สำหรับ MiMo-V3 โดยผ่านการแชร์ KV สองขั้นและการเลือกความหายากระดับโทเค็น เพื่อปรับปรุงการอนุมานของ Agent ในบริบทยาว","url":"https://www.aioga.com/th/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:10:22.176Z"},"pl":{"title":"Xiaomi ujawnia główną architekturę MiMo-V3 HySparse2: optymalizacja wydajności wnioskowania dla długodystansowych wielorundowych agentów","summary":"Xiaomi ujawniło jądrową architekturę HySparse2 dla MiMo-V3, optymalizując długoterminowe wnioskowanie agenta poprzez dwustopniowe współdzielenie KV i wybór rzadkich tokenów.","category":"行业动态","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Xiaomi ujawnia główną architekturę MiMo-V3 HySparse2: optymalizacja wydajności wnioskowania dla długodystansowych wielorundowych agentów - Aioga Wiadomości AI","description":"Xiaomi ujawniło jądrową architekturę HySparse2 dla MiMo-V3, optymalizując długoterminowe wnioskowanie agenta poprzez dwustopniowe współdzielenie KV i wybór rzadkich tokenów.","url":"https://www.aioga.com/pl/news/cmuf9rxjt06cnrocs35twhqm2/","contentTranslated":true,"sourceHash":"5a5aaf23aa9091a1","translatedAt":"2026-09-24T09:11:20.530Z"}},"evidenceTier":"verified-news","reviewStatus":"automated-ingest","indexable":true,"editorialCover":""}}