통이천문이 Qwen3.8-Flash를 발표했습니다. 이 모델은 다중 모달 MoE 모델로, Qwen4 아키텍처의 초기 미리보기 버전이며 가중치를 공개합니다. 이 모델의 총 파라미터는
125B이고, 각 토큰마다 6B만 활성화되며, 학습 비용은 Qwen3.7-Plus의 1/9에 불과하며, 성능은 전반적으로 후자를 능가합니다. 생산 버전 API 가격은 입력 토큰 1M당 $0.16, 출력 토큰 1M당 $0.47이며, 기본 컨텍스트는 262K이고, 1M까지 확장 가능합니다. 🔗 원문 보기 via AIHOT · https://aihot.virxact.com/items/cmta9ciqt07c1roj219h5liie
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。
该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。
生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmta9ciqt07c1roj219h5liie
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.