阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS,提供Flash(实时交互)和Plus(高质量生成)两个版本。
新功能包括细粒度内联标签控制(如【whisper】、【angry】)、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的长文本。
该模型目前在Artificial Analysis TTS排行榜上排名第一。
알리통의 우이첸원은 최신 텍스트-투-스피치 모델 Qwen-Audio-3.0-TTS를 출시했으며, Flash(실시간 상호작용)와 Plus(고품질 생성) 두 가지 버전을 제공합니다. 새로운 기능에는 세분화된 인라인 태그 제어(예: 【whisper】, 【angry】), 자연어 스타일...
알리통의 우이첸원은 최신 텍스트-투-스피치 모델 Qwen-Audio-3.0-TTS를 출시했으며, Flash(실시간 상호작용)와 Plus(고품질 생성) 두 가지 버전을 제공합니다.
새로운 기능에는 세분화된 인라인 태그 제어(예: 【whisper】, 【angry】), 자연어 스타일 제어, 16개 언어 지원, 최대 3분 길이의 긴 텍스트 한 번에 생성이 포함됩니다. 이 모델은 현재 Artificial Analysis TTS 순위에서 1위를 차지하고 있습니다.
阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS,提供Flash(实时交互)和Plus(高质量生成)两个版本。
新功能包括细粒度内联标签控制(如【whisper】、【angry】)、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的长文本。
该模型目前在Artificial Analysis TTS排行榜上排名第一。
通义千问发布Qwen-Audio-3.0-TTS,分为面向实时交互的Flash版和面向高质量生成的Plus版,并称该模型目前位列Artificial Analysis TTS排行榜第一。
公开材料显示,新模型支持细粒度内联标签与自然语言风格控制,可通过【whisper】、【angry】等标签调整表达;同时支持16种语言,单次可生成最长3分钟的文本语音。
Aioga判断,Flash与Plus的版本划分体现了对实时性和生成质量两类需求的分别覆盖;内联标签和自然语言控制则可能降低用户精细调整语音风格的操作门槛。
Aioga判断,16种语言、最长3分钟生成以及多种风格控制能力,可能扩大该模型在多语言内容和较长语音生成场景中的适用范围,但实际效果仍需结合具体使用结果评估。 值得关注的是,后续公开信息能否进一步说明Flash与Plus在延迟、质量及适用场景上的差异,以及排行榜第一所依据的具体测试维度和评估条件。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: 요약 집계 · 원본 도메인: x.com
출처: X:通义千问 / Qwen (@Alibaba_Qwen)
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: social-summary · Updated: 2026-07-23T12:33:27.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.