通义千问开源 Qwen3.8-Flash-Next,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览。
该模型采用 GDN + QSA 混合注意力等四项升级,总参数 125B,每 token 激活 6B,训练成本约为 Qwen3.7-Plus 的 1/9,编码与办公任务能力更强。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta2veap03nmrolwxllvp4ay
통의천문 오픈소스 Qwen3.8-Flash-Next는 멀티모달 MoE 모델로, Qwen4 아키텍처의 초기 미리보기 버전이기도 합니다. 이 모델은 GDN + QSA 혼합 어텐션 등 네 가지 업그레이드를 적용하였으며, 총 파라미터 수 125B, 토큰당 활성화 6B, 학습 비용은 Q...
통의천문 오픈소스 Qwen3.8-Flash-Next는 멀티모달 MoE 모델로, Qwen4 아키텍처의 초기 미리보기 버전이기도 합니다. 이 모델은 GDN + QSA 혼합 어텐션 등
네 가지 업그레이드를 적용하였으며, 총 파라미터 수 125B, 토큰당 활성화 6B, 학습 비용은 Qwen3.7-Plus의 약 1/9이며, 인코딩 및 오피스 작업 능력이 더 강력합니다. 🔗 원문 읽기 via AIHOT · https://aihot.virxact.com/items/cmta2veap03nmrolwxllvp4ay
通义千问开源 Qwen3.8-Flash-Next,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览。
该模型采用 GDN + QSA 混合注意力等四项升级,总参数 125B,每 token 激活 6B,训练成本约为 Qwen3.7-Plus 的 1/9,编码与办公任务能力更强。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta2veap03nmrolwxllvp4ay
通义千问开源 Qwen3.8-Flash-Next,并将其定位为多模态 MoE 模型及 Qwen4 架构的早期预览。材料称,该模型总参数为 125B,每 token 激活 6B。
公开材料介绍,Qwen3.8-Flash-Next 采用 GDN 与 QSA 混合注意力等四项升级,训练成本约为 Qwen3.7-Plus 的九分之一,并强调编码与办公任务能力更强。
Aioga 判断,这次发布的核心信号是架构预览与模型开源同时推进。材料对能力提升作出概括,但未提供具体评测数据,因此不宜据此断言其全面领先。
值得关注的是,125B 总参数与每 token 激活 6B 的组合,显示该模型在参数规模和单 token 激活量之间进行了取舍。其实际效率与任务表现仍需结合公开测试进一步核验。 建议持续核对 Qwen 官方后续材料,重点关注四项架构升级的完整说明、编码与办公任务的评测方法及结果,以及训练成本口径,避免仅依据摘要判断模型价值。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: REST API · 원본 도메인: qwen.ai
출처: Qwen:Blog Retrieval(API
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: summary-fallback · Updated: 2026-08-26T12:30:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.