通义千问发布第三代图像生成基座模型 Qwen-Image-3.0,核心关键词为"实"。

该模型支持最长 4.5k token 指令输入,可单次生成包含 9 个复杂信息图的 3×3 网格布局;

文本渲染精度达 10px,并支持 12 种语言原生渲染,旨在将图像转化为可部署的生产力工具。