{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-07-23T06:40:50.084Z","headline":"通义实验室发布 Wan-Streamer v0.2，端到端响应延迟仅 550ms","description":"通义实验室发布 Wan-Streamer v0.2，这是一款将\"听、看、说、演\"统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms，输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS，并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。","url":"https://www.aioga.com/news/cmrolz26304oqbito42v7oeaz/","mainEntityOfPage":"https://www.aioga.com/news/cmrolz26304oqbito42v7oeaz/","datePublished":"2026-07-17T07:14:00.000Z","dateModified":"2026-07-17T07:14:00.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://mp.weixin.qq.com/s/_eaO0wmsiQFGsrE2_zW_Dg","https://aihot.virxact.com/items/cmrolz26304oqbito42v7oeaz"],"canonicalUrl":"https://www.aioga.com/news/cmrolz26304oqbito42v7oeaz/","directAnswer":{"@type":"Answer","text":"通义实验室发布端到端全模态模型 Wan-Streamer v0.2，将“听、看、说、演”统一进单个 Transformer，端到端响应延迟为 550ms。","url":"https://www.aioga.com/news/cmrolz26304oqbito42v7oeaz/","dateCreated":"2026-07-17T07:14:00.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"公众号：通义实验室（千问） source article","url":"https://mp.weixin.qq.com/s/_eaO0wmsiQFGsrE2_zW_Dg","datePublished":"2026-07-17T07:14:00.000Z","provider":{"@type":"Organization","name":"公众号：通义实验室（千问）","url":"https://mp.weixin.qq.com/s/_eaO0wmsiQFGsrE2_zW_Dg"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.virxact.com/items/cmrolz26304oqbito42v7oeaz","datePublished":"2026-07-17T07:14:00.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.virxact.com/items/cmrolz26304oqbito42v7oeaz"}}],"aggregationSource":"公众号：通义实验室（千问）","originalPublisher":{"name":"公众号：通义实验室（千问）","url":"https://mp.weixin.qq.com/s/_eaO0wmsiQFGsrE2_zW_Dg"},"article":{"id":"cmrolz26304oqbito42v7oeaz","slug":"cmrolz26304oqbito42v7oeaz","url":"https://www.aioga.com/news/cmrolz26304oqbito42v7oeaz/","title":"通义实验室发布 Wan-Streamer v0.2，端到端响应延迟仅 550ms","title_en":"Wan-Streamer v0.2：响应延迟仅550ms，让 AI 真正与你\"面对面\"","summary":"通义实验室发布 Wan-Streamer v0.2，这是一款将\"听、看、说、演\"统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms，输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS，并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。","source":"公众号：通义实验室（千问）","sourceUrl":"https://mp.weixin.qq.com/s/_eaO0wmsiQFGsrE2_zW_Dg","aiHotUrl":"https://aihot.virxact.com/items/cmrolz26304oqbito42v7oeaz","publishedAt":"2026-07-17T07:14:00.000Z","category":"模型更新","score":69,"selected":true,"articleBody":["通义实验室发布 Wan-Streamer v0.2，这是一款将\"听、看、说、演\"统一进单个 Transformer 的端到端全模态模型。","其端到端响应延迟仅 550ms，输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS，并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。"],"articleImages":[],"mediaStatus":"none","articleBodyZh":[],"translationStatus":"","bodyOrigin":"summary-fallback","editorial":{"summary":"通义实验室发布端到端全模态模型 Wan-Streamer v0.2，将“听、看、说、演”统一进单个 Transformer，端到端响应延迟为 550ms。","background":"公开材料显示，v0.2 的输出分辨率由 v0.1 的 192×336 提升至 640×368，并以 25FPS 输出，形成了版本间的明确参数对比。","viewpoint":"Aioga 判断，此次更新的核心看点是同时推进输出画质与响应速度，并通过 Thinker-Performer 双通路架构维持较低延迟。","implications":"值得关注的是，将多种交互能力统一到单个 Transformer，可能为实时全模态交互提供新的技术路径，但材料未说明实际应用效果。","nextStep":"后续值得关注公开材料是否补充测试环境、延迟口径、画质评测方法及实际场景表现，以便判断这些指标在不同条件下的稳定性。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-07-23T01:49:51.086Z","sourceHash":"1535bd5b942aef68","review":{"approved":true,"groundedness":94,"clarity":92,"duplicationRisk":32,"blockingIssues":[],"notes":["“同时推进输出画质与响应速度”略强于来源表述；来源明确支持画质提升并维持极低延迟，但未提供 v0.2 相较 v0.1 的延迟对比。可选地改为“提升输出画质并维持较低延迟”，表述会更精确。","“可能为实时全模态交互提供新的技术路径”已使用可能性措辞，并明确指出材料未说明实际应用效果，属于合理观点而非无来源事实断言。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","low-source-overlap","no-html","independent-ai-review"]}},"tags":["模型更新","公众号：通义实验室（千问）"],"translations":{"zh-CN":{"title":"通义实验室发布 Wan-Streamer v0.2，端到端响应延迟仅 550ms","summary":"通义实验室发布 Wan-Streamer v0.2，这是一款将\"听、看、说、演\"统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms，输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS，并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"通义实验室发布 Wan-Streamer v0.2，端到端响应延迟仅 550ms - Aioga AI资讯","description":"通义实验室发布 Wan-Streamer v0.2，这是一款将\"听、看、说、演\"统一进单个 Transformer 的端到端全模态模型。其端到端响应延迟仅 550ms，输出分辨率从 v0.1 的 192×336 提升至 640×368 @ 25FPS，并采用 Thinker-Performer 双通路架构在提升画质的同时维持了极低延迟。","url":"https://www.aioga.com/news/cmrolz26304oqbito42v7oeaz/"},"en":{"title":"Tongyi Lab released Wan-Streamer v0.2, with end-to-end response latency of only 550ms","summary":"Tongyi Lab has released Wan-Streamer v0.2, an end-to-end full-modal model that integrates \"listening, watching, speaking, and performing\" into a single Transformer. Its end-to-end response latency is only 550ms, output resolution has been increased from 192×336 in v0.1 to 640×368 @ 25FPS, and it uses a Thinker-Performer dual-channel architecture to improve image quality while maintaining ultra-low latency.","category":"Models","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab released Wan-Streamer v0.2, with end-to-end response latency of only 550ms - Aioga AI News","description":"Tongyi Lab has released Wan-Streamer v0.2, an end-to-end full-modal model that integrates \"listening, watching, speaking, and performing\" into a single Transformer. Its end-to-end ","url":"https://www.aioga.com/en/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-18T04:59:03.284Z"},"ja":{"title":"Tongyi LabはWan-Streamer v0.2をリリースし、エンドツーエンドの応答遅延はわずか550msでした","summary":"Tongyi Labは、Wan-Streamer v0.2をリリースしました。これは「聴く、見る、話す、実行」を一つのトランスフォーマーに統合したエンドツーエンドのフルモーダルモデルです。 エンドツーエンドの応答遅延はわずか550msで、出力解像度はv0.1の192×336から640×368 @ 25FPSに向上し、Thinker-Performerのデュアルチャネルアーキテクチャを採用し、超低遅延を維持しつつ画質を向上させています。","category":"モデル更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi LabはWan-Streamer v0.2をリリースし、エンドツーエンドの応答遅延はわずか550msでした - Aioga AIニュース","description":"Tongyi Labは、Wan-Streamer v0.2をリリースしました。これは「聴く、見る、話す、実行」を一つのトランスフォーマーに統合したエンドツーエンドのフルモーダルモデルです。 エンドツーエンドの応答遅延はわずか550msで、出力解像度はv0.1の192×336から640×368 @ 25FPSに向上し、Thinker-Performerのデュア","url":"https://www.aioga.com/ja/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-18T04:59:22.116Z"},"ko":{"title":"통이 랩은 완 스트리머 v0.2를 출시했으며, 종단 간 응답 지연 시간은 단 550ms에 불과합니다","summary":"통이 랩은 '듣기, 관찰, 말하기, 연주'를 하나의 트랜스포머로 통합한 종단 간 풀 모달 모델인 Wan-Streamer v0.2를 출시했습니다. 종단 간 응답 지연 시간은 단 550ms에 불과하며, 출력 해상도는 v0.1의 192×336에서 640×368 @ 25FPS로 향상되었고, 초저지연을 유지하면서 화질을 향상시키는 Thinker-Performer 듀얼 채널 아키텍처를 사용합니다.","category":"모델 업데이트","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"통이 랩은 완 스트리머 v0.2를 출시했으며, 종단 간 응답 지연 시간은 단 550ms에 불과합니다 - Aioga AI 뉴스","description":"통이 랩은 '듣기, 관찰, 말하기, 연주'를 하나의 트랜스포머로 통합한 종단 간 풀 모달 모델인 Wan-Streamer v0.2를 출시했습니다. 종단 간 응답 지연 시간은 단 550ms에 불과하며, 출력 해상도는 v0.1의 192×336에서 640×368 @ 25FPS로 향상되었고, 초저지연을 유지하면서 화질을 향상시키는","url":"https://www.aioga.com/ko/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-18T04:59:41.853Z"},"es":{"title":"Tongyi Lab lanzó Wan-Streamer v0.2, con una latencia de respuesta de extremo a extremo de solo 550 ms","summary":"Tongyi Lab ha lanzado Wan-Streamer v0.2, un modelo modal completo de extremo a extremo que integra \"escuchar, observar, hablar y actuar\" en un solo Transformer. Su latencia de respuesta de extremo a extremo es solo de 550 ms, la resolución de salida ha aumentado de 192×336 en v0.1 a 640×368 @ 25FPS, y utiliza una arquitectura de doble canal Thinker-Performer para mejorar la calidad de imagen manteniendo una latencia ultra baja.","category":"Modelos","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab lanzó Wan-Streamer v0.2, con una latencia de respuesta de extremo a extremo de solo 550 ms - Aioga Noticias de IA","description":"Tongyi Lab ha lanzado Wan-Streamer v0.2, un modelo modal completo de extremo a extremo que integra \"escuchar, observar, hablar y actuar\" en un solo Transformer. Su latencia de resp","url":"https://www.aioga.com/es/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-18T05:00:02.130Z"},"fr":{"title":"Tongyi Lab a publié Wan-Streamer v0.2, avec une latence de réponse de bout en bout de seulement 550 ms","summary":"Tongyi Lab a publié Wan-Streamer v0.2, un modèle modal complet de bout en bout qui intègre « écouter, regarder, parler et performer » dans un seul Transformer. Sa latence de réponse de bout en bout n’est que de 550 ms, la résolution de sortie est passée de 192×336 en v0.1 à 640×368 @ 25FPS, et il utilise une architecture Thinker-Performer à double canal pour améliorer la qualité d’image tout en maintenant une latence ultra-faible.","category":"Modèles","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab a publié Wan-Streamer v0.2, avec une latence de réponse de bout en bout de seulement 550 ms - Aioga Actualités IA","description":"Tongyi Lab a publié Wan-Streamer v0.2, un modèle modal complet de bout en bout qui intègre « écouter, regarder, parler et performer » dans un seul Transformer. Sa latence de répons","url":"https://www.aioga.com/fr/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-18T05:00:21.395Z"},"de":{"title":"Tongyi Lab veröffentlicht Wan-Streamer v0.2, End-to-End-Antwortverzögerung nur 550 ms","summary":"Tongyi Lab veröffentlicht Wan-Streamer v0.2, ein End-to-End-Vollmodus-Modell, das \"Hören, Sehen, Sprechen und Darstellen\" in einen einzigen Transformer integriert. Die End-to-End-Antwortverzögerung beträgt nur 550 ms, die Ausgaberesolution wurde von 192×336 in v0.1 auf 640×368 @ 25FPS erhöht, und dank der Thinker-Performer Dual-Path-Architektur wird die Bildqualität verbessert, während eine extrem niedrige Latenz beibehalten wird.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab veröffentlicht Wan-Streamer v0.2, End-to-End-Antwortverzögerung nur 550 ms - Aioga KI-News","description":"Tongyi Lab veröffentlicht Wan-Streamer v0.2, ein End-to-End-Vollmodus-Modell, das \"Hören, Sehen, Sprechen und Darstellen\" in einen einzigen Transformer integriert. Die End-to-End-A","url":"https://www.aioga.com/de/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.359Z"},"pt-BR":{"title":"O Laboratório Tongyi lança o Wan-Streamer v0.2, com latência de resposta de ponta a ponta de apenas 550ms","summary":"O Laboratório Tongyi lançou o Wan-Streamer v0.2, um modelo multimodal de ponta a ponta que unifica \"ouvir, ver, falar e interpretar\" em um único Transformer. Sua latência de resposta de ponta a ponta é de apenas 550ms, a resolução de saída aumentou de 192×336 na v0.1 para 640×368 @ 25FPS, e adota a arquitetura dual Thinker-Performer, mantendo muito baixa latência enquanto melhora a qualidade da imagem.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"O Laboratório Tongyi lança o Wan-Streamer v0.2, com latência de resposta de ponta a ponta de apenas 550ms - Aioga Notícias de IA","description":"O Laboratório Tongyi lançou o Wan-Streamer v0.2, um modelo multimodal de ponta a ponta que unifica \"ouvir, ver, falar e interpretar\" em um único Transformer. Sua latência de respos","url":"https://www.aioga.com/pt-BR/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.819Z"},"ru":{"title":"Лаборатория Tongyi выпустила Wan-Streamer v0.2 с задержкой отклика всего 550 мс","summary":"Лаборатория Tongyi выпустила Wan-Streamer v0.2 — это полноформатная модель с единым трансформером, объединяющая функции \"слушать, смотреть, говорить, выступать\". Задержка отклика от конца до конца составляет всего 550 мс, разрешение вывода увеличено с 192×336 в версии v0.1 до 640×368 @ 25 FPS, а двухканальная архитектура Thinker-Performer позволяет улучшить качество изображения при сохранении минимальной задержки.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Лаборатория Tongyi выпустила Wan-Streamer v0.2 с задержкой отклика всего 550 мс - Aioga Новости ИИ","description":"Лаборатория Tongyi выпустила Wan-Streamer v0.2 — это полноформатная модель с единым трансформером, объединяющая функции \"слушать, смотреть, говорить, выступать\". Задержка отклика о","url":"https://www.aioga.com/ru/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:56.701Z"},"ar":{"title":"أصدرت مختبر تونغيي Wan-Streamer v0.2، بوقت استجابة من طرف إلى طرف يبلغ 550 مللي ثانية فقط","summary":"أصدرت مختبر تونغيي Wan-Streamer v0.2، وهو نموذج متعدد الوسائط من طرف إلى طرف يجمع بين \"الاستماع، والمشاهدة، والتحدث، والأداء\" في محول واحد. وقت الاستجابة من طرف إلى طرف يبلغ 550 مللي ثانية فقط، ودقة الإخراج ارتفعت من 192×336 في v0.1 إلى 640×368 @ 25FPS، ويستخدم هيكلية Thinker-Performer ثنائية المسار لتحسين جودة الصورة مع الحفاظ على تأخير منخفض للغاية.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"أصدرت مختبر تونغيي Wan-Streamer v0.2، بوقت استجابة من طرف إلى طرف يبلغ 550 مللي ثانية فقط - Aioga أخبار الذكاء الاصطناعي","description":"أصدرت مختبر تونغيي Wan-Streamer v0.2، وهو نموذج متعدد الوسائط من طرف إلى طرف يجمع بين \"الاستماع، والمشاهدة، والتحدث، والأداء\" في محول واحد. وقت الاستجابة من طرف إلى طرف يبلغ 550 مل","url":"https://www.aioga.com/ar/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:56.688Z"},"hi":{"title":"Tongyi लैब ने Wan-Streamer v0.2 जारी किया, एंड-टू-एंड प्रतिक्रिया विलंब केवल 550ms","summary":"Tongyi लैब ने Wan-Streamer v0.2 जारी किया, यह एक एंड-टू-एंड ऑल-मॉडल मॉडल है जो \"सुनना, देखना, बोलना, प्रदर्शन करना\" को एक ही Transformer में एकीकृत करता है। इसका एंड-टू-एंड प्रतिक्रिया विलंब केवल 550ms है, आउटपुट रिज़ॉल्यूशन v0.1 के 192×336 से बढ़कर 640×368 @ 25FPS हो गया है, और Thinker-Performer डुअल-पाथ आर्किटेक्चर का उपयोग करके चित्र गुणवत्ता बढ़ाते हुए बेहद कम विलंब बनाए रखा गया है।","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi लैब ने Wan-Streamer v0.2 जारी किया, एंड-टू-एंड प्रतिक्रिया विलंब केवल 550ms - Aioga AI समाचार","description":"Tongyi लैब ने Wan-Streamer v0.2 जारी किया, यह एक एंड-टू-एंड ऑल-मॉडल मॉडल है जो \"सुनना, देखना, बोलना, प्रदर्शन करना\" को एक ही Transformer में एकीकृत करता है। इसका एंड-टू-एंड प्रतिक्","url":"https://www.aioga.com/hi/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:56.433Z"},"it":{"title":"Tongyi Lab rilascia Wan-Streamer v0.2, con latenza di risposta end-to-end di soli 550ms","summary":"Tongyi Lab rilascia Wan-Streamer v0.2, un modello multimodale end-to-end che unifica 'ascoltare, vedere, parlare e recitare' in un singolo Transformer. La latenza di risposta end-to-end è di soli 550ms, la risoluzione di output è aumentata da 192×336 della versione v0.1 a 640×368 @ 25FPS, e adotta un'architettura a doppio canale Thinker-Performer che migliora la qualità dell'immagine mantenendo una latenza estremamente bassa.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab rilascia Wan-Streamer v0.2, con latenza di risposta end-to-end di soli 550ms - Aioga Notizie IA","description":"Tongyi Lab rilascia Wan-Streamer v0.2, un modello multimodale end-to-end che unifica 'ascoltare, vedere, parlare e recitare' in un singolo Transformer. La latenza di risposta end-t","url":"https://www.aioga.com/it/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.787Z"},"nl":{"title":"Tongyi Lab brengt Wan-Streamer v0.2 uit, met een end-to-end reactievertraging van slechts 550ms","summary":"Tongyi Lab brengt Wan-Streamer v0.2 uit, een end-to-end multimodaal model dat 'luisteren, kijken, spreken en uitvoeren' samenbrengt in één enkele Transformer. De end-to-end reactievertraging is slechts 550ms, de uitvoerresolutie is verhoogd van 192×336 in v0.1 naar 640×368 @ 25FPS, en met een Thinker-Performer dubbele pad-architectuur wordt de beeldkwaliteit verbeterd terwijl een zeer lage vertraging behouden blijft.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab brengt Wan-Streamer v0.2 uit, met een end-to-end reactievertraging van slechts 550ms - Aioga AI-nieuws","description":"Tongyi Lab brengt Wan-Streamer v0.2 uit, een end-to-end multimodaal model dat 'luisteren, kijken, spreken en uitvoeren' samenbrengt in één enkele Transformer. De end-to-end reactie","url":"https://www.aioga.com/nl/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.790Z"},"tr":{"title":"Tongyi Laboratuvarı, Wan-Streamer v0.2 sürümünü yayımladı, uçtan uca yanıt gecikmesi yalnızca 550ms","summary":"Tongyi Laboratuvarı, \"dinle, izle, konuş, göster\" işlevlerini tek bir Transformer'da birleştiren uçtan uca tam modlu model Wan-Streamer v0.2'yi yayınladı. Uçtan uca yanıt gecikmesi yalnızca 550ms olup, çıktı çözünürlüğü v0.1'in 192×336 değerinden 640×368 @ 25FPS seviyesine yükseltildi ve Thinker-Performer çift kanallı mimari kullanılarak görüntü kalitesi artırılırken düşük gecikme korundu.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Laboratuvarı, Wan-Streamer v0.2 sürümünü yayımladı, uçtan uca yanıt gecikmesi yalnızca 550ms - Aioga AI Haberleri","description":"Tongyi Laboratuvarı, \"dinle, izle, konuş, göster\" işlevlerini tek bir Transformer'da birleştiren uçtan uca tam modlu model Wan-Streamer v0.2'yi yayınladı. Uçtan uca yanıt gecikmesi","url":"https://www.aioga.com/tr/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.987Z"},"vi":{"title":"Phòng thí nghiệm Tongyi ra mắt Wan-Streamer v0.2, độ trễ phản hồi đầu cuối chỉ 550ms","summary":"Phòng thí nghiệm Tongyi ra mắt Wan-Streamer v0.2, đây là một mô hình toàn phương thức đầu-cuối tích hợp 'nghe, nhìn, nói, biểu diễn' vào một Transformer duy nhất. Độ trễ phản hồi đầu-cuối chỉ 550ms, độ phân giải đầu ra tăng từ 192×336 của v0.1 lên 640×368 @ 25FPS và sử dụng kiến trúc hai kênh Thinker-Performer để nâng cao chất lượng hình ảnh đồng thời duy trì độ trễ cực thấp.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Phòng thí nghiệm Tongyi ra mắt Wan-Streamer v0.2, độ trễ phản hồi đầu cuối chỉ 550ms - Tin tức AI Aioga","description":"Phòng thí nghiệm Tongyi ra mắt Wan-Streamer v0.2, đây là một mô hình toàn phương thức đầu-cuối tích hợp 'nghe, nhìn, nói, biểu diễn' vào một Transformer duy nhất. Độ trễ phản hồi đ","url":"https://www.aioga.com/vi/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:56.408Z"},"id":{"title":"Tongyi Lab merilis Wan-Streamer v0.2, latensi respons end-to-end hanya 550ms","summary":"Tongyi Lab merilis Wan-Streamer v0.2, sebuah model multimodal end-to-end yang menyatukan \"mendengar, melihat, berbicara, dan menampilkan\" ke dalam satu Transformer. Latensi respons end-to-end-nya hanya 550ms, resolusi keluaran meningkat dari 192×336 di v0.1 menjadi 640×368 @ 25FPS, dan menggunakan arsitektur dual-stream Thinker-Performer yang meningkatkan kualitas gambar sambil mempertahankan latensi yang sangat rendah.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab merilis Wan-Streamer v0.2, latensi respons end-to-end hanya 550ms - Berita AI Aioga","description":"Tongyi Lab merilis Wan-Streamer v0.2, sebuah model multimodal end-to-end yang menyatukan \"mendengar, melihat, berbicara, dan menampilkan\" ke dalam satu Transformer. Latensi respons","url":"https://www.aioga.com/id/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.444Z"},"th":{"title":"Tongyi Lab เปิดตัว Wan-Streamer v0.2 ความหน่วงการตอบสนองแบบ end-to-end เพียง 550ms","summary":"Tongyi Lab เปิดตัว Wan-Streamer v0.2 ซึ่งเป็นโมเดลมัลติฟังก์ชันแบบ end-to-end ที่รวม \"ฟัง ดู พูด แสดง\" เข้าไว้ในหนึ่ง Transformer ความหน่วงการตอบสนองแบบ end-to-end เพียง 550ms ความละเอียดของผลลัพธ์เพิ่มจาก v0.1 ที่ 192×336 เป็น 640×368 @ 25FPS และใช้สถาปัตยกรรม Thinker-Performer แบบสองช่องทางในการปรับปรุงคุณภาพภาพขณะรักษาความหน่วงต่ำสุด","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab เปิดตัว Wan-Streamer v0.2 ความหน่วงการตอบสนองแบบ end-to-end เพียง 550ms - ข่าว AI Aioga","description":"Tongyi Lab เปิดตัว Wan-Streamer v0.2 ซึ่งเป็นโมเดลมัลติฟังก์ชันแบบ end-to-end ที่รวม \"ฟัง ดู พูด แสดง\" เข้าไว้ในหนึ่ง Transformer ความหน่วงการตอบสนองแบบ end-to-end เพียง 550ms ความ","url":"https://www.aioga.com/th/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:55.962Z"},"pl":{"title":"Tongyi Lab wypuszcza Wan-Streamer v0.2, opóźnienie odpowiedzi end-to-end wynosi tylko 550 ms","summary":"Tongyi Lab wypuszcza Wan-Streamer v0.2, który jest end-to-end pełnym modelem multimodalnym łączącym \"słuchanie, oglądanie, mówienie i wykonywanie\" w jednym Transformerze. Jego opóźnienie odpowiedzi end-to-end wynosi tylko 550 ms, rozdzielczość wyjściowa wzrosła z 192×336 w wersji v0.1 do 640×368 @ 25FPS, a zastosowana architektura Thinker-Performer o podwójnym kanale pozwala utrzymać bardzo niskie opóźnienie przy poprawie jakości obrazu.","category":"模型更新","source":"公众号：通义实验室（千问）","aggregationSource":"公众号：通义实验室（千问）","pageTitle":"Tongyi Lab wypuszcza Wan-Streamer v0.2, opóźnienie odpowiedzi end-to-end wynosi tylko 550 ms - Aioga Wiadomości AI","description":"Tongyi Lab wypuszcza Wan-Streamer v0.2, który jest end-to-end pełnym modelem multimodalnym łączącym \"słuchanie, oglądanie, mówienie i wykonywanie\" w jednym Transformerze. Jego opóź","url":"https://www.aioga.com/pl/news/cmrolz26304oqbito42v7oeaz/","contentTranslated":true,"sourceHash":"d3973d7c4f9b5b90","translatedAt":"2026-07-19T15:57:57.047Z"}}}}