{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-08-11T09:21:12.743Z","headline":"华为昇腾宣布支持 RL 训推一致性，实测最高获 60% 性能收益","description":"华为昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上实现 Logdiff 为 0，并通过 FA 算子优化在 Eager 模式下获得 20%-60% 性能收益。相关基础设施已开源，还将上线\"训推一致问题识别 Skill\"以排查残余 logdiff。","url":"https://www.aioga.com/news/cmshapv0x05ldronkm8s29tq2/","mainEntityOfPage":"https://www.aioga.com/news/cmshapv0x05ldronkm8s29tq2/","datePublished":"2026-08-06T08:13:17.000Z","dateModified":"2026-08-06T08:13:17.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://www.ithome.com/0/986/564.htm","https://aihot.virxact.com/items/cmshapv0x05ldronkm8s29tq2"],"canonicalUrl":"https://www.aioga.com/news/cmshapv0x05ldronkm8s29tq2/","directAnswer":{"@type":"Answer","text":"华为昇腾基于 Ascend C 提供训推一致算子集，在 Qwen3-30B MoE 模型测试中实现 Logdiff 为 0；经 FA 算子优化，Eager 模式性能收益为 20%-60%，相关基础设施已开源。","url":"https://www.aioga.com/news/cmshapv0x05ldronkm8s29tq2/","dateCreated":"2026-08-06T08:13:17.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"IT之家 source article","url":"https://www.ithome.com/0/986/564.htm","datePublished":"2026-08-06T08:13:17.000Z","provider":{"@type":"Organization","name":"IT之家","url":"https://www.ithome.com/0/986/564.htm"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.virxact.com/items/cmshapv0x05ldronkm8s29tq2","datePublished":"2026-08-06T08:13:17.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.virxact.com/items/cmshapv0x05ldronkm8s29tq2"}}],"aggregationSource":"IT之家（RSS）","originalPublisher":{"name":"IT之家","url":"https://www.ithome.com/0/986/564.htm"},"geoDeepAnswer":null,"article":{"id":"cmshapv0x05ldronkm8s29tq2","slug":"cmshapv0x05ldronkm8s29tq2","url":"https://www.aioga.com/news/cmshapv0x05ldronkm8s29tq2/","title":"华为昇腾宣布支持 RL 训推一致性，实测最高获 60% 性能收益","title_en":"华为昇腾宣布已支持 RL 训推一致性，实测获得最高 60% 性能收益","summary":"华为昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上实现 Logdiff 为 0，并通过 FA 算子优化在 Eager 模式下获得 20%-60% 性能收益。相关基础设施已开源，还将上线\"训推一致问题识别 Skill\"以排查残余 logdiff。","source":"IT之家（RSS）","sourceUrl":"https://www.ithome.com/0/986/564.htm","aiHotUrl":"https://aihot.virxact.com/items/cmshapv0x05ldronkm8s29tq2","publishedAt":"2026-08-06T08:13:17.000Z","category":"产品更新","score":60,"selected":false,"articleBody":["IT之家：https://www.ithome.com/ 8 月 6 日消息，强化学习已成为大模型训练主流范式，推动模型技术向行业核心场景工程化落地。其中，训推一致至关重要，因推理与训练过程耦合，基础设施差异易放大不确定性。","华为计算官方 8 月 5 日宣布，昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上的测试实现 Logdiff 为 0，并通过昇腾亲和的 FA 算子优化， 在 Eager 模式下获得 20%-60% 性能收益 ，为开发者提供高效可靠的强化学习训练方案。","RL 后训练训推不一致最根本的原因， 是底层计算时累加不保序 。若要从上到下保证训练引擎与推理引擎每一次累加顺序一致，需要框架侧与算子侧同时发力。模型参数越大，问题会进一步放大：张量并行、专家并行等切分策略，以及集合通信路径，任一环节对不齐，都无法做到最终的 true-on-policy。算子还需要覆盖多种调用场景，在关键计算步骤上施加约束，同时把性能损失控制在可用范围内 —— 这是一项系统性工程挑战。","训推不一致，指的是 Rollout（推理）引擎与训练引擎之间的数值不一致性 。即使两者使用完全相同的模型权重，对相同 Token 序列计算得到的对数概率（logprob）也可能存在细微差异；该差异通常用 logdiff 衡量。","昇腾基于 Ascend C 编程语言对训推链路中的关键算子做了系统性约束与对齐，核心思路是：让训练与推理在「该累加的地方」走同一套数值路径，主要涉及如下 4 个修改：","统一注意力语义： 对齐训练掩码 Softmax 与推理逐步注意力在有效位置上的计算范围，消除因可见 Token 集合不同带来的数值差。","锁定 reduce 累加序： 约束训练 FA、推理 PFA / PagedAttention 在规约维度上的切分与归约顺序，避免「同模板不同切分」导致的累加不保序。","对齐在线 Softmax 分块策略： 统一分块大小与归约节奏，避免 decoder 侧多块合并 Softmax 与训练侧分块 Softmax 不一致。","对齐关键路径精度： 在 Softmax 累加等敏感步骤上统一精度转换策略，减少混合精度实现差异引入的尾数误差。","在此基础上，再配合 FA 下发与调度优化，使训推一致不再以显著性能回退为代价，从而在实测中同时拿到 logdiff=0 与端到端加速。","华为宣布相关基础设施已开源 ，还将上线“训推一致问题识别 Skill”，支持排查残余 logdiff、定位是算子路径问题还是框架实现差异。","https://github.com/verl-project/verl-ascend-recipe/tree/main/true_on_policy ：https://github.com/verl-project/verl-ascend-recipe/tree/main/true_on_policy"],"articleImages":[{"sourceUrl":"https://img.ithome.com/newsuploadfiles/2026/8/235d7bc4-ccaf-466c-bb2c-03ee4f08d805.png?x-bce-process=image/format,f_auto","alt":"图片","afterParagraph":3,"url":"/media/articles/cmshapv0x05ldronkm8s29tq2/e7a0ffc70b421bf1.webp"},{"sourceUrl":"https://img.ithome.com/newsuploadfiles/2026/8/5fd4aa2c-9203-44a4-9fb4-f28cd0ceea89.png?x-bce-process=image/format,f_auto","alt":"图片","afterParagraph":8,"url":"/media/articles/cmshapv0x05ldronkm8s29tq2/ba2e94ff2c4be9a8.webp"}],"mediaStatus":"ok","articleBodyZh":["华为昇腾宣布支持 RL 训推一致性，实测最高获 60% 性能收益 这条更新来自 ithome.com，发布时间为 2026-08-06，Aioga 保留原文入口以便核验。","摘要：华为昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上实现 Logdiff 为 0，并通过 FA 算子优化在 Eager 模式下获得 20%-60% 性能收益。相关基础设施已开源，还将上线\"训推一致问题识别 Skill\"以排查残余 logdiff。","背景：RL 后训练中，推理引擎与训练引擎即使使用相同模型权重，对相同 Token 序列计算的 logprob 仍可能存在差异。材料称，底层累加不保序以及并行切分、集合通信路径差异均会影响训推一致性。","Aioga 观察：Aioga 判断，此次更新的重点不只是单项算子提速，而是同时约束注意力语义、规约累加顺序和在线 Softmax 分块策略，尝试在数值一致性与可用性能之间建立可验证的工程方案。","影响与后续：值得关注的是，材料披露的 Logdiff 为 0 与 20%-60% 性能收益均来自 Qwen3-30B MoE 及 Eager 模式下的特定测试，尚不能直接推定其他模型、并行策略或运行模式会获得相同结果。 Aioga 判断，后续应关注开源基础设施在更多模型与并行配置中的复现结果，以及计划上线的“训推一致问题识别 Skill”能否定位残余 logdiff，并披露更完整的测试条件与对比口径。"],"translationStatus":"","bodyOrigin":"source-page","editorial":{"summary":"华为昇腾基于 Ascend C 提供训推一致算子集，在 Qwen3-30B MoE 模型测试中实现 Logdiff 为 0；经 FA 算子优化，Eager 模式性能收益为 20%-60%，相关基础设施已开源。","background":"RL 后训练中，推理引擎与训练引擎即使使用相同模型权重，对相同 Token 序列计算的 logprob 仍可能存在差异。材料称，底层累加不保序以及并行切分、集合通信路径差异均会影响训推一致性。","viewpoint":"Aioga 判断，此次更新的重点不只是单项算子提速，而是同时约束注意力语义、规约累加顺序和在线 Softmax 分块策略，尝试在数值一致性与可用性能之间建立可验证的工程方案。","implications":"值得关注的是，材料披露的 Logdiff 为 0 与 20%-60% 性能收益均来自 Qwen3-30B MoE 及 Eager 模式下的特定测试，尚不能直接推定其他模型、并行策略或运行模式会获得相同结果。","nextStep":"Aioga 判断，后续应关注开源基础设施在更多模型与并行配置中的复现结果，以及计划上线的“训推一致问题识别 Skill”能否定位残余 logdiff，并披露更完整的测试条件与对比口径。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-08-08T11:11:40.675Z","sourceHash":"636c4e0443f8cdd0","review":{"approved":true,"groundedness":96,"clarity":92,"duplicationRisk":18,"blockingIssues":[],"notes":["“可验证的工程方案”属于带有限定的分析性表述，已通过“Aioga 判断”和“尝试”明确为观点，不构成事实冒充。","“披露更完整的测试条件与对比口径”是后续关注建议，不应理解为来源已承诺披露这些信息。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","low-source-overlap","no-html","independent-ai-review"]}},"tags":["产品更新","IT之家（RSS）"],"translations":{"zh-CN":{"title":"华为昇腾宣布支持 RL 训推一致性，实测最高获 60% 性能收益","summary":"华为昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上实现 Logdiff 为 0，并通过 FA 算子优化在 Eager 模式下获得 20%-60% 性能收益。相关基础设施已开源，还将上线\"训推一致问题识别 Skill\"以排查残余 logdiff。","category":"产品更新","source":"IT之家","aggregationSource":"IT之家（RSS）","pageTitle":"华为昇腾宣布支持 RL 训推一致性，实测最高获 60% 性能收益 - Aioga AI资讯","description":"华为昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上实现 Logdiff 为 0，并通过 FA 算子优化在 Eager 模式下获得 20%-60% 性能收益。相关基础设施已开源，还将上线\"训推一致问题识别 Skill\"以排查残余 logdiff。","url":"https://www.aioga.com/news/cmshapv0x05ldronkm8s29tq2/","articleBody":["华为昇腾宣布支持 RL 训推一致性，实测最高获 60% 性能收益 这条更新来自 ithome.com，发布时间为 2026-08-06，Aioga 保留原文入口以便核验。","摘要：华为昇腾基于 Ascend C 编程语言提供完整训推一致算子集，在 Qwen3-30B MoE 模型上实现 Logdiff 为 0，并通过 FA 算子优化在 Eager 模式下获得 20%-60% 性能收益。相关基础设施已开源，还将上线\"训推一致问题识别 Skill\"以排查残余 logdiff。","背景：RL 后训练中，推理引擎与训练引擎即使使用相同模型权重，对相同 Token 序列计算的 logprob 仍可能存在差异。材料称，底层累加不保序以及并行切分、集合通信路径差异均会影响训推一致性。","Aioga 观察：Aioga 判断，此次更新的重点不只是单项算子提速，而是同时约束注意力语义、规约累加顺序和在线 Softmax 分块策略，尝试在数值一致性与可用性能之间建立可验证的工程方案。","影响与后续：值得关注的是，材料披露的 Logdiff 为 0 与 20%-60% 性能收益均来自 Qwen3-30B MoE 及 Eager 模式下的特定测试，尚不能直接推定其他模型、并行策略或运行模式会获得相同结果。 Aioga 判断，后续应关注开源基础设施在更多模型与并行配置中的复现结果，以及计划上线的“训推一致问题识别 Skill”能否定位残余 logdiff，并披露更完整的测试条件与对比口径。"]},"en":{"title":"Huawei Ascend announces support for RL training and inference consistency, with measured performance gains of up to 60%","summary":"Huawei Ascend provides a complete set of training-inference consistent operators based on the Ascend C programming language, achieving a Logdiff of 0 on the Qwen3-30B MoE model, and obtaining 20%-60% performance gains in Eager mode through FA operator optimization. The related infrastructure has been open-sourced, and a 'Training-Inference Consistency Issue Identification Skill' will also be launched to detect residual logdiff.","category":"Products","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend announces support for RL training and inference consistency, with measured performance gains of up to 60% - Aioga AI News","description":"Huawei Ascend provides a complete set of training-inference consistent operators based on the Ascend C programming language, achieving a Logdiff of 0 on the Qwen3-30B MoE model, an...","url":"https://www.aioga.com/en/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:42:26.807Z"},"ja":{"title":"ファーウェイ昇騰はRL訓練と推論の一貫性をサポートすることを発表、実測で最高60％の性能向上を獲得","summary":"ファーウェイのAscendは、Ascend Cプログラミング言語に基づき、完全な訓練・推論一貫オペレーターセットを提供し、Qwen3-30B MoEモデルでLogdiffを0に達成し、FAオペレーターの最適化によりEagerモードで20%-60%の性能向上を得ています。関連する基盤インフラはオープンソース化されており、残余のlogdiffを検出するための「訓練・推論一貫問題識別スキル」も近日公開予定です。","category":"製品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"ファーウェイ昇騰はRL訓練と推論の一貫性をサポートすることを発表、実測で最高60％の性能向上を獲得 - Aioga AIニュース","description":"ファーウェイのAscendは、Ascend Cプログラミング言語に基づき、完全な訓練・推論一貫オペレーターセットを提供し、Qwen3-30B MoEモデルでLogdiffを0に達成し、FAオペレーターの最適化によりEagerモードで20%-60%の性能向上を得ています。関連する基盤インフラはオープンソース化されており、残余のlogdiffを検出するための「訓...","url":"https://www.aioga.com/ja/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:42:33.846Z"},"ko":{"title":"화웨이 셩텅, RL 학습-추론 일관성 지원 발표, 실제 테스트에서 최고 60% 성능 향상","summary":"화웨이 승등은 Ascend C 프로그래밍 언어를 기반으로 완전한 훈추 일관 연산자 세트를 제공하며, Qwen3-30B MoE 모델에서 Logdiff를 0으로 구현하고, FA 연산자 최적화를 통해 Eager 모드에서 20%-60% 성능 향상을 얻었습니다. 관련 인프라는 이미 오픈소스화되었으며, 잔여 logdiff를 점검하기 위해 '훈추 일관 문제 식별 Skill'도 곧 출시될 예정입니다.","category":"제품 업데이트","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"화웨이 셩텅, RL 학습-추론 일관성 지원 발표, 실제 테스트에서 최고 60% 성능 향상 - Aioga AI 뉴스","description":"화웨이 승등은 Ascend C 프로그래밍 언어를 기반으로 완전한 훈추 일관 연산자 세트를 제공하며, Qwen3-30B MoE 모델에서 Logdiff를 0으로 구현하고, FA 연산자 최적화를 통해 Eager 모드에서 20%-60% 성능 향상을 얻었습니다. 관련 인프라는 이미 오픈소스화되었으며, 잔여 logdiff를 점검하기...","url":"https://www.aioga.com/ko/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:43:31.030Z"},"es":{"title":"Huawei Ascend anuncia soporte para la consistencia de entrenamiento e inferencia en RL, con un beneficio de rendimiento máximo probado del 60%","summary":"Huawei Ascend proporciona un conjunto completo de operadores consistentes para entrenamiento e inferencia basado en el lenguaje de programación Ascend C, logrando Logdiff de 0 en el modelo Qwen3-30B MoE, y obteniendo una ganancia de rendimiento del 20%-60% en modo Eager mediante la optimización de operadores FA. La infraestructura relacionada ya está de código abierto, y también se lanzará la 'Habilidad de identificación de problemas consistentes de entrenamiento e inferencia' para detectar logdiff residuales.","category":"Productos","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend anuncia soporte para la consistencia de entrenamiento e inferencia en RL, con un beneficio de rendimiento máximo probado del 60% - Aioga Noticias de IA","description":"Huawei Ascend proporciona un conjunto completo de operadores consistentes para entrenamiento e inferencia basado en el lenguaje de programación Ascend C, logrando Logdiff de 0 en e...","url":"https://www.aioga.com/es/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:43:24.301Z"},"fr":{"title":"Huawei Ascend annonce le support de la cohérence formation-inférence RL, avec des tests montrant un gain de performance pouvant atteindre 60%","summary":"Huawei Ascend fournit un ensemble complet d'opérateurs cohérents pour l'entraînement et l'inférence basé sur le langage de programmation Ascend C, réalisant un Logdiff de 0 sur le modèle Qwen3-30B MoE, et obtenant un gain de performance de 20% à 60% en mode Eager grâce à l'optimisation des opérateurs FA. L'infrastructure correspondante a été open source, et le \"Skill d'identification des problèmes de cohérence entraînement-inférence\" sera également mis en ligne pour détecter les logdiff résiduels.","category":"Produits","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend annonce le support de la cohérence formation-inférence RL, avec des tests montrant un gain de performance pouvant atteindre 60% - Aioga Actualités IA","description":"Huawei Ascend fournit un ensemble complet d'opérateurs cohérents pour l'entraînement et l'inférence basé sur le langage de programmation Ascend C, réalisant un Logdiff de 0 sur le...","url":"https://www.aioga.com/fr/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:44:23.678Z"},"de":{"title":"Huawei Ascend kündigt Unterstützung für Konsistenz von RL-Training und -Inference an, tatsächliche Messungen zeigen bis zu 60% Leistungssteigerung","summary":"Huawei Ascend bietet auf Basis der Ascend C-Programmiersprache einen vollständigen Satz von Trainings- und Inferenzoperatoren, erreicht bei dem Qwen3-30B MoE-Modell eine Logdiff von 0 und erzielt durch FA-Operator-Optimierung im Eager-Modus eine Leistungssteigerung von 20%-60%. Die zugehörige Infrastruktur wurde bereits Open Source veröffentlicht, zudem wird die \"Trainings- und Inferenz-Konsistenzproblem-Erkennungs-Skill\" eingeführt, um verbleibende Logdiffs zu überprüfen.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend kündigt Unterstützung für Konsistenz von RL-Training und -Inference an, tatsächliche Messungen zeigen bis zu 60% Leistungssteigerung - Aioga KI-News","description":"Huawei Ascend bietet auf Basis der Ascend C-Programmiersprache einen vollständigen Satz von Trainings- und Inferenzoperatoren, erreicht bei dem Qwen3-30B MoE-Modell eine Logdiff vo...","url":"https://www.aioga.com/de/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:44:18.584Z"},"pt-BR":{"title":"Huawei Ascend anuncia suporte à consistência de treinamento e inferência de RL, com ganho de desempenho de até 60% em testes reais","summary":"A Huawei Ascend fornece um conjunto completo de operadores consistentes para treinamento e inferência com base na linguagem de programação Ascend C, alcançando Logdiff de 0 no modelo Qwen3-30B MoE, e obtendo ganhos de desempenho de 20% a 60% no modo Eager por meio da otimização de operadores FA. A infraestrutura relevante já foi aberta ao público e também será lançada a 'Habilidade de identificação de problemas de consistência de treinamento e inferência' para verificar logdiff residual.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend anuncia suporte à consistência de treinamento e inferência de RL, com ganho de desempenho de até 60% em testes reais - Aioga Notícias de IA","description":"A Huawei Ascend fornece um conjunto completo de operadores consistentes para treinamento e inferência com base na linguagem de programação Ascend C, alcançando Logdiff de 0 no mode...","url":"https://www.aioga.com/pt-BR/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:45:09.832Z"},"ru":{"title":"Huawei Ascend объявляет о поддержке согласованности обучения и вывода RL, реальное тестирование показало до 60% прироста производительности","summary":"Huawei Ascend предоставляет полный набор операторов для обучения и推ва на основе языка программирования Ascend C, достигая Logdiff равного 0 на модели Qwen3-30B MoE, и с помощью оптимизации операторов FA в режиме Eager достигается прирост производительности на 20%-60%. Соответствующая инфраструктура уже открыта для сообщества, также будет запущен \"Skill по выявлению проблем обучения и推\" для устранения остаточного logdiff.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend объявляет о поддержке согласованности обучения и вывода RL, реальное тестирование показало до 60% прироста производительности - Aioga Новости ИИ","description":"Huawei Ascend предоставляет полный набор операторов для обучения и推ва на основе языка программирования Ascend C, достигая Logdiff равного 0 на модели Qwen3-30B MoE, и с помощью опт...","url":"https://www.aioga.com/ru/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:45:19.344Z"},"ar":{"title":"أعلنت هواوي عن دعم Shengteng لتناسق تدريب ونشر التعلم المعزز، وتم قياس تحقيق أعلى استفادة من الأداء تصل إلى 60%","summary":"تقدم شركة هواوي Ascend مجموعة كاملة من المشغلات المتسقة بين التدريب والاستدلال استنادًا إلى لغة البرمجة Ascend C، وحققت نموذج Qwen3-30B MoE فرق سجل Logdiff صفر، ومن خلال تحسين مشغل FA تم تحقيق مكاسب أداء تتراوح بين 20% و60% في وضع Eager. البنية التحتية ذات الصلة مفتوحة المصدر بالفعل، وسيتم أيضًا إطلاق \"مهارة تحديد مشاكل التوافق بين التدريب والاستدلال\" لفحص الفرق المتبقي في logdiff.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"أعلنت هواوي عن دعم Shengteng لتناسق تدريب ونشر التعلم المعزز، وتم قياس تحقيق أعلى استفادة من الأداء تصل إلى 60% - Aioga أخبار الذكاء الاصطناعي","description":"تقدم شركة هواوي Ascend مجموعة كاملة من المشغلات المتسقة بين التدريب والاستدلال استنادًا إلى لغة البرمجة Ascend C، وحققت نموذج Qwen3-30B MoE فرق سجل Logdiff صفر، ومن خلال تحسين مشغل...","url":"https://www.aioga.com/ar/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:46:17.719Z"},"hi":{"title":"हुवावे शेंग्टेंग ने घोषित किया कि यह आरएल प्रशिक्षण और推推 संगति का समर्थन करता है, परीक्षण में अधिकतम 60% प्रदर्शन लाभ प्राप्त हुआ","summary":"हुवावे शेंगटेंग Ascend C प्रोग्रामिंग भाषा पर आधारित पूर्ण प्रशिक्षण-推一致 ऑपरेटर सेट प्रदान करता है, Qwen3-30B MoE मॉडल पर Logdiff को 0 पर प्राप्त करता है, और FA ऑपरेटर अनुकूलन के माध्यम से Eager मोड में 20%-60% प्रदर्शन लाभ प्राप्त करता है। संबंधित बुनियादी ढांचा पहले से ही ओपन-सोर्स है, और 'प्रशिक्षण-推一致 समस्या पहचान कौशल' भी शुरू किया जाएगा ताकि शेष logdiff की जांच की जा सके।","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"हुवावे शेंग्टेंग ने घोषित किया कि यह आरएल प्रशिक्षण और推推 संगति का समर्थन करता है, परीक्षण में अधिकतम 60% प्रदर्शन लाभ प्राप्त हुआ - Aioga AI समाचार","description":"हुवावे शेंगटेंग Ascend C प्रोग्रामिंग भाषा पर आधारित पूर्ण प्रशिक्षण-推一致 ऑपरेटर सेट प्रदान करता है, Qwen3-30B MoE मॉडल पर Logdiff को 0 पर प्राप्त करता है, और FA ऑपरेटर अनुकूलन के म...","url":"https://www.aioga.com/hi/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:46:17.780Z"},"it":{"title":"Huawei Ascend annuncia il supporto alla coerenza di addestramento e inferenza RL, con un guadagno di prestazioni massimo misurato del 60%","summary":"Huawei Ascend fornisce un set completo di operatori coerenti per l'addestramento e l'inferenza basati sul linguaggio di programmazione Ascend C, realizzando un Logdiff pari a 0 sul modello Qwen3-30B MoE, e ottenendo un incremento delle prestazioni del 20%-60% in modalità Eager grazie all'ottimizzazione tramite operatori FA. Le infrastrutture correlate sono già open source e sarà lanciata anche la \"Skill per l'identificazione dei problemi di coerenza tra training e inference\" per esaminare eventuali logdiff residui.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend annuncia il supporto alla coerenza di addestramento e inferenza RL, con un guadagno di prestazioni massimo misurato del 60% - Aioga Notizie IA","description":"Huawei Ascend fornisce un set completo di operatori coerenti per l'addestramento e l'inferenza basati sul linguaggio di programmazione Ascend C, realizzando un Logdiff pari a 0 sul...","url":"https://www.aioga.com/it/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:47:17.654Z"},"nl":{"title":"Huawei Ascend kondigt ondersteuning aan voor RL-trainings- en inferentieconsistentie, met een werkelijke maximale prestatiewinst van 60%","summary":"Huawei Ascend biedt een volledig consistente operator-set op basis van de Ascend C programmeertaal, realiseert Logdiff van 0 op het Qwen3-30B MoE-model, en behaalt 20%-60% prestatiewinst in Eager-modus via FA-operatoroptimalisatie. De gerelateerde infrastructuur is open source gemaakt, en er zal ook een 'Train-Predict Consistency Problem Identification Skill' worden gelanceerd om resterende logdiff op te sporen.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend kondigt ondersteuning aan voor RL-trainings- en inferentieconsistentie, met een werkelijke maximale prestatiewinst van 60% - Aioga AI-nieuws","description":"Huawei Ascend biedt een volledig consistente operator-set op basis van de Ascend C programmeertaal, realiseert Logdiff van 0 op het Qwen3-30B MoE-model, en behaalt 20%-60% prestati...","url":"https://www.aioga.com/nl/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:47:13.001Z"},"tr":{"title":"Huawei Ascend, RL eğitim ve çıkarım tutarlılığını desteklediğini açıkladı, yapılan testlerde en yüksek %60 performans artışı elde edildi","summary":"Huawei Ascend, Ascend C programlama diline dayalı olarak tam eğitim-çıkarım uyumlu operatör seti sunar, Qwen3-30B MoE modelinde Logdiff'ı 0 olarak gerçekleştirir ve FA operatör optimizasyonu sayesinde Eager modda %20-%60 performans artışı elde eder. İlgili altyapı açık kaynak olarak sunulmuştur ve ayrıca kalan logdiff'i tespit etmek için 'eğitim-çıkarım uyumlu problem tanılama Yeteneği' de kullanıma sunulacaktır.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend, RL eğitim ve çıkarım tutarlılığını desteklediğini açıkladı, yapılan testlerde en yüksek %60 performans artışı elde edildi - Aioga AI Haberleri","description":"Huawei Ascend, Ascend C programlama diline dayalı olarak tam eğitim-çıkarım uyumlu operatör seti sunar, Qwen3-30B MoE modelinde Logdiff'ı 0 olarak gerçekleştirir ve FA operatör opt...","url":"https://www.aioga.com/tr/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:48:09.588Z"},"vi":{"title":"Huawei Ascend công bố hỗ trợ nhất quán huấn luyện và suy luận RL, thử nghiệm thực tế đạt lợi ích hiệu năng cao nhất 60%","summary":"Huawei Ascend dựa trên ngôn ngữ lập trình Ascend C cung cấp bộ toán tử thống nhất cho huấn luyện và suy luận, đạt Logdiff bằng 0 trên mô hình Qwen3-30B MoE và đạt được lợi ích hiệu suất 20%-60% trong chế độ Eager thông qua tối ưu toán tử FA. Cơ sở hạ tầng liên quan đã được mã nguồn mở, và sẽ ra mắt \"Kỹ năng nhận dạng vấn đề thống nhất huấn luyện-suy luận\" để kiểm tra logdiff còn tồn đọng.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend công bố hỗ trợ nhất quán huấn luyện và suy luận RL, thử nghiệm thực tế đạt lợi ích hiệu năng cao nhất 60% - Tin tức AI Aioga","description":"Huawei Ascend dựa trên ngôn ngữ lập trình Ascend C cung cấp bộ toán tử thống nhất cho huấn luyện và suy luận, đạt Logdiff bằng 0 trên mô hình Qwen3-30B MoE và đạt được lợi ích hiệu...","url":"https://www.aioga.com/vi/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:48:21.066Z"},"id":{"title":"Huawei Ascend mengumumkan dukungan untuk konsistensi pelatihan dan inferensi RL, pengujian nyata menunjukkan peningkatan kinerja hingga 60%","summary":"Huawei Ascend menyediakan kumpulan operator konsisten pelatihan-inferensi lengkap berdasarkan bahasa pemrograman Ascend C, mencapai Logdiff 0 pada model Qwen3-30B MoE, dan memperoleh peningkatan kinerja 20%-60% dalam mode Eager melalui optimasi operator FA. Infrastruktur terkait telah dibuka sumbernya, dan \"Skill Identifikasi Masalah Konsistensi Pelatihan-Inferensi\" akan segera diluncurkan untuk memeriksa logdiff residual.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend mengumumkan dukungan untuk konsistensi pelatihan dan inferensi RL, pengujian nyata menunjukkan peningkatan kinerja hingga 60% - Berita AI Aioga","description":"Huawei Ascend menyediakan kumpulan operator konsisten pelatihan-inferensi lengkap berdasarkan bahasa pemrograman Ascend C, mencapai Logdiff 0 pada model Qwen3-30B MoE, dan memperol...","url":"https://www.aioga.com/id/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:49:13.316Z"},"th":{"title":"หัวเว่ย Ascend ประกาศสนับสนุนความสอดคล้องในการฝึกและ推ของ RL ทำการทดสอบจริงได้ประสิทธิภาพสูงสุดเพิ่มขึ้น 60%","summary":"หัวเว่ย Ascend ให้ชุดตัวดำเนินการที่สอดคล้องกันทั้งการฝึกและ推บนพื้นฐานของภาษาโปรแกรม Ascend C ในโมเดล Qwen3-30B MoE สามารถทำให้ Logdiff เป็น 0 และผ่านการปรับแต่งตัวดำเนินการ FA ในโหมด Eager ได้รับประสิทธิภาพเพิ่มขึ้น 20%-60% โครงสร้างพื้นฐานที่เกี่ยวข้องได้เปิดซอร์สแล้ว และจะเปิดตัว \"ทักษะการระบุปัญหาสอดคล้องการฝึกและ推\" เพื่อค้นหาผล logdiff ที่เหลืออยู่","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"หัวเว่ย Ascend ประกาศสนับสนุนความสอดคล้องในการฝึกและ推ของ RL ทำการทดสอบจริงได้ประสิทธิภาพสูงสุดเพิ่มขึ้น 60% - ข่าว AI Aioga","description":"หัวเว่ย Ascend ให้ชุดตัวดำเนินการที่สอดคล้องกันทั้งการฝึกและ推บนพื้นฐานของภาษาโปรแกรม Ascend C ในโมเดล Qwen3-30B MoE สามารถทำให้ Logdiff เป็น 0 และผ่านการปรับแต่งตัวดำเนินการ FA ในโ...","url":"https://www.aioga.com/th/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:49:27.547Z"},"pl":{"title":"Huawei Ascend ogłosił wsparcie dla spójności treningu i inferencji RL, rzeczywiste testy wykazały maksymalny wzrost wydajności o 60%","summary":"Huawei Ascend zapewnia pełny zestaw operatorów konsekwentnych do trenowania i推owania na podstawie języka programowania Ascend C, osiągając logdiff równe 0 w modelu Qwen3-30B MoE oraz uzyskując 20%-60% wzrost wydajności w trybie Eager dzięki optymalizacji operatora FA. Powiązana infrastruktura została udostępniona jako open source, a wkrótce zostanie uruchomiona \"Umiejętność identyfikacji problemów z trenowaniem i 推owaniem\", aby wyeliminować pozostałe logdiff.","category":"产品更新","source":"IT之家（RSS）","aggregationSource":"IT之家（RSS）","pageTitle":"Huawei Ascend ogłosił wsparcie dla spójności treningu i inferencji RL, rzeczywiste testy wykazały maksymalny wzrost wydajności o 60% - Aioga Wiadomości AI","description":"Huawei Ascend zapewnia pełny zestaw operatorów konsekwentnych do trenowania i推owania na podstawie języka programowania Ascend C, osiągając logdiff równe 0 w modelu Qwen3-30B MoE or...","url":"https://www.aioga.com/pl/news/cmshapv0x05ldronkm8s29tq2/","contentTranslated":true,"sourceHash":"1aa7960c87309a70","translatedAt":"2026-08-06T10:50:25.849Z"}}}}