Tongyi Qianwen ने Qwen3.8-Flash जारी किया, एक बहु-मोडल MoE मॉडल, जो Qwen4 आर्किटेक्चर का शुरुआती
पूर्वावलोकन है और इसके वजन को खोला गया है। इस मॉडल में कुल 125B पैरामीटर्स हैं, प्रत्येक टोकन केवल 6B को सक्रिय करता है, प्रशिक्षण लागत केवल Qwen3.7-Plus की 1/9 है, और प्रदर्शन पूरी तरह से उससे आगे है। प्रोडक्शन संस्करण API की कीमत $0.16/1M इनपुट टोकन्स और $0.47/1M आउटपुट टोकन्स है, मूल संदर्भ 262K है, और इसे 1M तक बढ़ाया जा सकता है। 🔗 मूल लेख पढ़ें via AIHOT · https://aihot.virxact.com/items/cmta9ciqt07c1roj219h5liie
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。
该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。
生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta9ciqt07c1roj219h5liie