Black Forest Labs a lancé le modèle fondamental multimodal FLUX 3 en accès anticipé, utilisant une architecture unifiée pour l'apprentissage conjoint d'ima...
模型更新IT之家(RSS)
Brief IA du jour
Black Forest Labs a lancé le modèle fondamental multimodal FLUX 3 en accès anticipé, utilisant une
architecture unifiée pour l'apprentissage conjoint d'images, de vidéos et d'audio. Ce modèle est basé sur le cadre d'apprentissage Self-Flow étendu, pouvant produire jusqu'à 20 secondes de vidéo avec audio natif en une seule génération, et prend en charge des tâches telles que la génération de vidéo à partir de texte, la génération de vidéo à partir d'images et la concaténation de plusieurs plans.
Aioga 判断,统一处理图像、视频与音频是此次更新的核心看点,20 秒单次生成和原生音频有助于减少分段制作环节。不过模型仍处于 Early Access 阶段,其稳定性与实际工作流表现仍值得关注。
影响与后续
该模型可能推动视频生成从单一画面输出转向音画联合生成,并为多镜头内容制作提供新的实现方式。官方人工评测给出了与三款模型的对比胜率,但这些结果仍需结合评测条件和独立测试理解。 后续应关注 Early Access 的开放范围、实际生成质量与任务稳定性,并核验其在不同语言、分辨率、多镜头衔接和音视频续写场景中的表现。机器人行为预测合作的研究进展也值得持续跟踪。
Source and Copyright
La source fournit un titre, un résumé, une attribution et un lien original. Aioga ne republie pas l’article intégral.
Canal de collecte: RSS · Domaine source: ithome.com
Black Forest Labs a lancé le modèle fondamental multimodal FLUX 3 en accès anticipé, utilisant une architecture unifiée pour l'apprentissage conjoint d'ima...
IT之家(RSS)2026-07-24T06:48:04.000Z
Scan to open this article
Aioga agrège l’actualité mondiale de l’IA et conserve les sources pour vérification et citation.