Aioga
AI资讯 / 模型更新
返回 AI资讯

Qwen 3.0 Image Pro 发布:支持 4.5k token 输入与 10px 级文字渲染

Hacker News 热门(buzzing.cc 中文翻译)Aioga 编辑团队2026-08-05T17:11:39.800Z热度 53

通义千问推出 Qwen-Image-3.0-Pro 图像生成模型,支持最多 4.5k token 输入和图文混排,可一次生成报纸、分镜、菜单等复杂版式。模型能精确渲染小至 10...

模型更新Hacker News 热门(buzzing.cc 中文翻译)

今日 AI 情报摘要

通义千问推出 Qwen-Image-3.0-Pro 图像生成模型,支持最多 4.5k token 输入和图文混排,可一次生成报纸、分镜、菜单等复杂版式。

模型能精确渲染小至 10px 的文字,原生支持 12 种语言和 20+ 字体,并模拟网页、游戏、直播等主流界面。 API 定价为 1K 图像输入 $0.003、1K 图像输出 $0.04。

中文正文 · AI 翻译

丰富内容:支持最多 4,500 个标记的输入和带有“图中图”信息密集布局,能够一次性生成诸如报纸、分镜板、菜单和试卷等复杂布局。真实细节:支持精确渲染最小 10px 的文本,并生动呈现微表情、毛孔和单根头发等细节——接近真实摄影的质量。深度知识:支持 12 种语言和 20 多种字体的原生渲染,逼真模拟网页、游戏和直播等主流界面,充分整合外部知识。Qwen-Image-3.0-Pro 不仅追求“好看”,更追求“有用”,使图像生成真正成为可部署的生产力工具。

QwenCloud LOGO
QwenCloud LOGO
Qwen 3.0 Image Pro 发布:支持 4.5k token 输入与 10px 级文字渲染

情报判断

Aioga 编辑摘要

Qwen-Image-3.0-Pro 已发布,公开材料称其最多支持 4.5k token 输入,可单次生成报纸、分镜、菜单等图文混排内容,并支持小至 10px 的文字渲染。

背景分析

材料将该模型定位为可部署的图像生产力工具,强调密集信息排版、图中图、细节表现与界面模拟;摘要还列出原生支持 12 种语言、20+ 字体及 API 计价信息。

Aioga 观点

Aioga 判断,本次更新的重点并非单纯提升画面观感,而是扩大复杂版式与可读文字的生成范围。不过,10px 文字精度及接近真实摄影等表述目前仅来自产品材料。

影响与后续

若公开能力在实际调用中保持稳定,该模型可能适用于菜单、试卷、分镜和界面原型等信息密集场景。值得关注的是,多语言文字准确率、复杂布局一致性与调用成本仍需独立测试。 建议后续使用包含小字号、多语言、图中图及网页界面的固定样例进行对比测试,并按摘要所列输入与输出价格核算完整任务成本,同时核验单次生成结果的文字和排版错误率。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: 摘要聚合 · 原始域名: qwencloud.com

来源: Hacker News 热门(buzzing.cc 中文翻译)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-05T17:11:39.800Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

通义千问推出 Qwen-Image-3.0-Pro 图像生成模型,支持最多 4.5k token 输入和图文混排,可一次生成报纸、分镜、菜单等复杂版式。模型能精确渲染小至 10...

Hacker News 热门(buzzing.cc 中文翻译)2026-08-05T17:11:39.800Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。