Tongyi Qianwen выпустила Qwen3.8-Flash, мультимодальную модель MoE, в качестве раннего
предварительного просмотра архитектуры Qwen4 с открытыми весами. Общие параметры модели составляют 125 млрд, при этом активируются только 6 млрд на каждый токен, стоимость обучения составляет всего 1/9 от Qwen3.7-Plus, а производительность полностью превосходит последнего. Цены на производственный API: $0,16/1 млн входных токенов и $0,47/1 млн выходных токенов, нативный контекст 262K, с возможностью масштабирования до 1 млн. 🔗 Читать оригинал через AIHOT · https://aihot.virxact.com/items/cmta9ciqt07c1roj219h5liie
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。
该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。
生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta9ciqt07c1roj219h5liie