{"@context":"https://schema.org","@type":"NewsArticle","generatedAt":"2026-07-23T06:40:50.084Z","headline":"NVIDIA 发布 Audio-Visual Flamingo：面向长视频的开放音频-视觉大语言模型","description":"NVIDIA 推出 Nemotron-Labs-Audio-Visual Flamingo（AV-Flamingo），一个完全开源的音频-视觉大语言模型，专为理解和推理长视频中的音频、图像与复杂场景设计。","url":"https://www.aioga.com/news/cmrsmh6lu0aj0biwmsi84t57e/","mainEntityOfPage":"https://www.aioga.com/news/cmrsmh6lu0aj0biwmsi84t57e/","datePublished":"2026-07-17T00:00:00.000Z","dateModified":"2026-07-17T00:00:00.000Z","inLanguage":"zh-CN","publisher":{"@type":"NewsMediaOrganization","name":"Aioga","url":"https://www.aioga.com"},"citation":["https://arxiv.org/abs/2607.16107","https://aihot.virxact.com/items/cmrsmh6lu0aj0biwmsi84t57e"],"canonicalUrl":"https://www.aioga.com/news/cmrsmh6lu0aj0biwmsi84t57e/","directAnswer":{"@type":"Answer","text":"材料称，NVIDIA 推出 Nemotron-Labs-Audio-Visual Flamingo（AV-Flamingo），定位为完全开源的音频-视觉大语言模型，面向长视频中的音频、图像与复杂场景理解及推理。","url":"https://www.aioga.com/news/cmrsmh6lu0aj0biwmsi84t57e/","dateCreated":"2026-07-17T00:00:00.000Z","author":{"@type":"Organization","@id":"https://www.aioga.com/authors/aioga-editorial/#editorial-team","name":"Aioga Editorial Team","url":"https://www.aioga.com/authors/aioga-editorial/"}},"evidence":[{"@type":"CreativeWork","name":"arXiv source article","url":"https://arxiv.org/abs/2607.16107","datePublished":"2026-07-17T00:00:00.000Z","provider":{"@type":"Organization","name":"arXiv","url":"https://arxiv.org/abs/2607.16107"}},{"@type":"CreativeWork","name":"AIHot archive record","url":"https://aihot.virxact.com/items/cmrsmh6lu0aj0biwmsi84t57e","datePublished":"2026-07-17T00:00:00.000Z","provider":{"@type":"Organization","name":"AIHot","url":"https://aihot.virxact.com/items/cmrsmh6lu0aj0biwmsi84t57e"}}],"aggregationSource":"HuggingFace Daily Papers（社区热门论文）","originalPublisher":{"name":"arXiv","url":"https://arxiv.org/abs/2607.16107"},"article":{"id":"cmrsmh6lu0aj0biwmsi84t57e","slug":"cmrsmh6lu0aj0biwmsi84t57e","url":"https://www.aioga.com/news/cmrsmh6lu0aj0biwmsi84t57e/","title":"NVIDIA 发布 Audio-Visual Flamingo：面向长视频的开放音频-视觉大语言模型","title_en":"Audio-Visual Flamingo： Open Audio-Visual Intelligence for Long and Complex Videos","summary":"NVIDIA 推出 Nemotron-Labs-Audio-Visual Flamingo（AV-Flamingo），一个完全开源的音频-视觉大语言模型，专为理解和推理长视频中的音频、图像与复杂场景设计。","source":"HuggingFace Daily Papers（社区热门论文）","sourceUrl":"https://arxiv.org/abs/2607.16107","aiHotUrl":"https://aihot.virxact.com/items/cmrsmh6lu0aj0biwmsi84t57e","publishedAt":"2026-07-17T00:00:00.000Z","category":"模型更新","score":73,"selected":true,"articleBody":["arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.","Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs ：https://info.arxiv.org/labs/index.html."],"articleImages":[{"sourceUrl":"https://arxiv.org/static/base/1.0.1/images/funders/simons-foundation.png","alt":"Simons Foundation","afterParagraph":1,"url":"/media/articles/cmrsmh6lu0aj0biwmsi84t57e/e2d7f38d62f5ca91.png"},{"sourceUrl":"https://arxiv.org/static/base/1.0.1/images/funders/simons-foundation-international.png","alt":"Simons Foundation International","afterParagraph":1,"url":"/media/articles/cmrsmh6lu0aj0biwmsi84t57e/1d56e29c5557cbdc.png"}],"mediaStatus":"ok","articleBodyZh":["arXivLabs 是一个框架，允许合作者直接在我们的网站上开发和分享新的 arXiv 功能。","有一个可以为 arXiv 社区增加价值的项目想法吗？了解更多关于 arXivLabs 的信息：https://info.arxiv.org/labs/index.html。"],"translationStatus":"translated","bodyOrigin":"source-page","editorial":{"summary":"材料称，NVIDIA 推出 Nemotron-Labs-Audio-Visual Flamingo（AV-Flamingo），定位为完全开源的音频-视觉大语言模型，面向长视频中的音频、图像与复杂场景理解及推理。","background":"该信息来自 HuggingFace Daily Papers 的社区热门论文条目。现有正文摘录仅介绍 arXivLabs 的协作功能，未提供模型架构、训练数据、评测结果或发布日期等细节。","viewpoint":"Aioga 判断，AV-Flamingo 的关注点在于把音频与视觉信息纳入长视频理解场景；但仅凭当前摘要，尚不足以判断其实际效果、开放范围及相对其他模型的优势。","implications":"若摘要所述定位得到论文与公开材料支持，该模型可能为长视频多模态研究提供可复用基础。不过，材料未说明许可协议、资源需求和基准成绩，实际影响仍待验证。","nextStep":"值得关注后续公开的论文全文、代码仓库、模型权重、许可证及评测设置，并核对“完全开源”的具体范围；在这些信息明确前，不宜扩展解读其性能、成本或应用成熟度。","evidenceRefs":["title","summary","articleBody","source"],"status":"published","aiGenerated":true,"autoApproved":true,"generatedBy":"aioga-editorial:gpt-5.6-sol","reviewedBy":"aioga-editorial-review:gpt-5.6-sol","generatedAt":"2026-07-22T22:31:03.182Z","sourceHash":"ad73de18290a9f87","review":{"approved":true,"groundedness":96,"clarity":92,"duplicationRisk":18,"blockingIssues":[],"notes":["候选内容准确区分了来源摘要中的已知信息与正文摘录未覆盖的细节，并对性能、开放范围和实际影响使用了审慎的条件式表述。","“Aioga 判断”中的主体名称缺少上下文说明，可能轻微影响独立阅读时的清晰度，但属于可选措辞优化，不构成阻断问题。"]},"validation":{"passed":true,"mode":"ai-auto","revisions":0,"checks":["schema","length","source-attribution","low-source-overlap","no-html","independent-ai-review"]}},"tags":["模型更新","HuggingFace Daily Papers（社区热门论文）"],"translations":{"zh-CN":{"title":"NVIDIA 发布 Audio-Visual Flamingo：面向长视频的开放音频-视觉大语言模型","summary":"NVIDIA 推出 Nemotron-Labs-Audio-Visual Flamingo（AV-Flamingo），一个完全开源的音频-视觉大语言模型，专为理解和推理长视频中的音频、图像与复杂场景设计。","category":"模型更新","source":"arXiv","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA 发布 Audio-Visual Flamingo：面向长视频的开放音频-视觉大语言模型 - Aioga AI资讯","description":"NVIDIA 推出 Nemotron-Labs-Audio-Visual Flamingo（AV-Flamingo），一个完全开源的音频-视觉大语言模型，专为理解和推理长视频中的音频、图像与复杂场景设计。","url":"https://www.aioga.com/news/cmrsmh6lu0aj0biwmsi84t57e/"},"en":{"title":"NVIDIA Releases Audio-Visual Flamingo: An Open Audio-Visual Large Language Model for Long Videos","summary":"NVIDIA has launched Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), a fully open-source audio-visual large language model designed specifically to understand and reason about audio, images, and complex scenes in long videos.","category":"Models","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA Releases Audio-Visual Flamingo: An Open Audio-Visual Large Language Model for Long Videos - Aioga AI News","description":"NVIDIA has launched Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), a fully open-source audio-visual large language model designed specifically to understand and reason about au...","url":"https://www.aioga.com/en/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:06:28.098Z"},"ja":{"title":"NVIDIA、Audio-Visual Flamingoを発表：長編動画向けのオープンオーディオ・ビジュアル大規模言語モデル","summary":"NVIDIAはNemotron-Labs-Audio-Visual Flamingo（AV-Flamingo）を発表しました。これは完全にオープンソースの音声・視覚大規模言語モデルで、長編動画の音声、画像、および複雑なシーンを理解し推論するために設計されています。","category":"モデル更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA、Audio-Visual Flamingoを発表：長編動画向けのオープンオーディオ・ビジュアル大規模言語モデル - Aioga AIニュース","description":"NVIDIAはNemotron-Labs-Audio-Visual Flamingo（AV-Flamingo）を発表しました。これは完全にオープンソースの音声・視覚大規模言語モデルで、長編動画の音声、画像、および複雑なシーンを理解し推論するために設計されています。","url":"https://www.aioga.com/ja/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:06:44.866Z"},"ko":{"title":"NVIDIA, Audio-Visual Flamingo 발표: 장편 비디오를 위한 오픈 오디오-비주얼 대형 언어 모델","summary":"NVIDIA는 Nemotron-Labs-Audio-Visual Flamingo(AV-Flamingo)를 출시했습니다. 이는 완전히 오픈 소스인 오디오-비주얼 대형 언어 모델로, 긴 동영상에서 오디오, 이미지 및 복잡한 장면을 이해하고 추론하도록 설계되었습니다.","category":"모델 업데이트","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA, Audio-Visual Flamingo 발표: 장편 비디오를 위한 오픈 오디오-비주얼 대형 언어 모델 - Aioga AI 뉴스","description":"NVIDIA는 Nemotron-Labs-Audio-Visual Flamingo(AV-Flamingo)를 출시했습니다. 이는 완전히 오픈 소스인 오디오-비주얼 대형 언어 모델로, 긴 동영상에서 오디오, 이미지 및 복잡한 장면을 이해하고 추론하도록 설계되었습니다.","url":"https://www.aioga.com/ko/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:07:34.910Z"},"es":{"title":"NVIDIA lanza Audio-Visual Flamingo: Modelo de lenguaje grande audio-visual abierto para videos largos","summary":"NVIDIA lanza Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), un modelo de lenguaje audiovisual completamente de código abierto, diseñado específicamente para comprender y razonar sobre el audio, las imágenes y las escenas complejas en videos largos.","category":"Modelos","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA lanza Audio-Visual Flamingo: Modelo de lenguaje grande audio-visual abierto para videos largos - Aioga Noticias de IA","description":"NVIDIA lanza Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), un modelo de lenguaje audiovisual completamente de código abierto, diseñado específicamente para comprender y razona...","url":"https://www.aioga.com/es/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:07:32.981Z"},"fr":{"title":"NVIDIA publie Audio-Visual Flamingo : un grand modèle de langage audiovisuel ouvert pour les vidéos longues","summary":"NVIDIA lance Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), un modèle de langage audio-visuel entièrement open source, conçu pour comprendre et raisonner sur l'audio, les images et les scènes complexes dans de longues vidéos.","category":"Modèles","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA publie Audio-Visual Flamingo : un grand modèle de langage audiovisuel ouvert pour les vidéos longues - Aioga Actualités IA","description":"NVIDIA lance Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), un modèle de langage audio-visuel entièrement open source, conçu pour comprendre et raisonner sur l'audio, les image...","url":"https://www.aioga.com/fr/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:08:17.475Z"},"de":{"title":"NVIDIA veröffentlicht Audio-Visual Flamingo: Offenes Audio-Visuelles Großsprachmodell für lange Videos","summary":"NVIDIA hat Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo) eingeführt, ein vollständig Open-Source Audio-Visuelles Sprachmodell, das speziell dafür entwickelt wurde, Audio, Bilder und komplexe Szenen in langen Videos zu verstehen und zu analysieren.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA veröffentlicht Audio-Visual Flamingo: Offenes Audio-Visuelles Großsprachmodell für lange Videos - Aioga KI-News","description":"NVIDIA hat Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo) eingeführt, ein vollständig Open-Source Audio-Visuelles Sprachmodell, das speziell dafür entwickelt wurde, Audio, Bilde...","url":"https://www.aioga.com/de/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:08:21.027Z"},"pt-BR":{"title":"NVIDIA lança Audio-Visual Flamingo: modelo de linguagem audiovisual aberto voltado para vídeos longos","summary":"A NVIDIA lançou o Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), um modelo de linguagem multimodal totalmente open source, projetado para compreender e raciocinar sobre áudio, imagens e cenários complexos em vídeos longos.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA lança Audio-Visual Flamingo: modelo de linguagem audiovisual aberto voltado para vídeos longos - Aioga Notícias de IA","description":"A NVIDIA lançou o Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), um modelo de linguagem multimodal totalmente open source, projetado para compreender e raciocinar sobre áudio,...","url":"https://www.aioga.com/pt-BR/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:09:04.381Z"},"ru":{"title":"NVIDIA выпустила Audio-Visual Flamingo: открытая аудиовизуальная большая языковая модель для длинных видео","summary":"NVIDIA представила Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), полностью открытый аудио-визуальный большой языковой модель, разработанный для понимания и рассуждения о звуке, изображениях и сложных сценах в длинных видео.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA выпустила Audio-Visual Flamingo: открытая аудиовизуальная большая языковая модель для длинных видео - Aioga Новости ИИ","description":"NVIDIA представила Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), полностью открытый аудио-визуальный большой языковой модель, разработанный для понимания и рассуждения о звуке...","url":"https://www.aioga.com/ru/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:09:07.226Z"},"ar":{"title":"أصدرت NVIDIA نموذج Flamingo السمعي-البصري: نموذج لغة كبير مفتوح للصوت والصورة مخصص للفيديوهات الطويلة","summary":"أطلقت NVIDIA نموذج Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo)، وهو نموذج لغة كبير صوتي بصري مفتوح المصدر بالكامل، مصمم لفهم واستنتاج الصوت والصورة والمشاهد المعقدة في مقاطع الفيديو الطويلة.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"أصدرت NVIDIA نموذج Flamingo السمعي-البصري: نموذج لغة كبير مفتوح للصوت والصورة مخصص للفيديوهات الطويلة - Aioga أخبار الذكاء الاصطناعي","description":"أطلقت NVIDIA نموذج Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo)، وهو نموذج لغة كبير صوتي بصري مفتوح المصدر بالكامل، مصمم لفهم واستنتاج الصوت والصورة والمشاهد المعقدة في مقاطع...","url":"https://www.aioga.com/ar/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:09:53.064Z"},"hi":{"title":"NVIDIA ने Audio-Visual Flamingo जारी किया: लंबे वीडियो के लिए खुला ऑडियो-विज़ुअल बड़ा भाषा मॉडल","summary":"NVIDIA ने Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo) लॉन्च किया, एक पूर्ण रूप से ओपन-सोर्स ऑडियो-विज़ुअल बड़ा भाषा मॉडल, जिसे लंबे वीडियो में ऑडियो, छवि और जटिल दृश्यों को समझने और तर्क करने के लिए डिज़ाइन किया गया है।","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA ने Audio-Visual Flamingo जारी किया: लंबे वीडियो के लिए खुला ऑडियो-विज़ुअल बड़ा भाषा मॉडल - Aioga AI समाचार","description":"NVIDIA ने Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo) लॉन्च किया, एक पूर्ण रूप से ओपन-सोर्स ऑडियो-विज़ुअल बड़ा भाषा मॉडल, जिसे लंबे वीडियो में ऑडियो, छवि और जटिल दृश्यों को स...","url":"https://www.aioga.com/hi/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:09:56.953Z"},"it":{"title":"NVIDIA lancia Audio-Visual Flamingo: modello linguistico audio-visivo aperto per video lunghi","summary":"NVIDIA ha lanciato Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), un modello linguistico audio-visivo completamente open source, progettato per comprendere e ragionare su audio, immagini e scene complesse in video lunghi.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA lancia Audio-Visual Flamingo: modello linguistico audio-visivo aperto per video lunghi - Aioga Notizie IA","description":"NVIDIA ha lanciato Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), un modello linguistico audio-visivo completamente open source, progettato per comprendere e ragionare su audio...","url":"https://www.aioga.com/it/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:10:48.784Z"},"nl":{"title":"NVIDIA lanceert Audio-Visual Flamingo: open audio-visueel groot taalkundig model voor lange video's","summary":"NVIDIA lanceert Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), een volledig open-source audio-visueel groot taalmodel, speciaal ontworpen voor het begrijpen en redeneren over audio, beelden en complexe scenario's in lange video's.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA lanceert Audio-Visual Flamingo: open audio-visueel groot taalkundig model voor lange video's - Aioga AI-nieuws","description":"NVIDIA lanceert Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), een volledig open-source audio-visueel groot taalmodel, speciaal ontworpen voor het begrijpen en redeneren over a...","url":"https://www.aioga.com/nl/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:10:40.647Z"},"tr":{"title":"NVIDIA Audio-Visual Flamingo'yu Yayınladı: Uzun Videolar İçin Açık Ses-Görsel Büyük Dil Modeli","summary":"NVIDIA, uzun videolardaki ses, görüntü ve karmaşık sahneleri anlamak ve akıl yürütmek için tasarlanmış tamamen açık kaynaklı bir ses-görsel büyük dil modeli olan Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo)'yu tanıttı.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA Audio-Visual Flamingo'yu Yayınladı: Uzun Videolar İçin Açık Ses-Görsel Büyük Dil Modeli - Aioga AI Haberleri","description":"NVIDIA, uzun videolardaki ses, görüntü ve karmaşık sahneleri anlamak ve akıl yürütmek için tasarlanmış tamamen açık kaynaklı bir ses-görsel büyük dil modeli olan Nemotron-Labs-Audi...","url":"https://www.aioga.com/tr/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:11:29.694Z"},"vi":{"title":"NVIDIA phát hành Audio-Visual Flamingo: Mô hình ngôn ngữ lớn âm-thị giác mở cho video dài","summary":"NVIDIA ra mắt Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), một mô hình ngôn ngữ lớn âm thanh-hình ảnh hoàn toàn mã nguồn mở, được thiết kế để hiểu và suy luận về âm thanh, hình ảnh và các cảnh phức tạp trong video dài.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA phát hành Audio-Visual Flamingo: Mô hình ngôn ngữ lớn âm-thị giác mở cho video dài - Tin tức AI Aioga","description":"NVIDIA ra mắt Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), một mô hình ngôn ngữ lớn âm thanh-hình ảnh hoàn toàn mã nguồn mở, được thiết kế để hiểu và suy luận về âm thanh, hì...","url":"https://www.aioga.com/vi/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:11:34.831Z"},"id":{"title":"NVIDIA merilis Audio-Visual Flamingo: Model bahasa besar audio-visual terbuka untuk video panjang","summary":"NVIDIA meluncurkan Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), sebuah model bahasa besar audio-visual yang sepenuhnya open source, dirancang khusus untuk memahami dan menalar audio, gambar, dan adegan kompleks dalam video panjang.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA merilis Audio-Visual Flamingo: Model bahasa besar audio-visual terbuka untuk video panjang - Berita AI Aioga","description":"NVIDIA meluncurkan Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), sebuah model bahasa besar audio-visual yang sepenuhnya open source, dirancang khusus untuk memahami dan menala...","url":"https://www.aioga.com/id/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:12:15.287Z"},"th":{"title":"NVIDIA เปิดตัว Audio-Visual Flamingo: โมเดลภาษาขนาดใหญ่แบบเสียง-ภาพเปิดสำหรับวิดีโอความยาว","summary":"NVIDIA เปิดตัว Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo) ซึ่งเป็นโมเดลภาษาขนาดใหญ่แบบเสียง-ภาพที่เปิดโอเพ่นซอร์สอย่างเต็มรูปแบบ ออกแบบมาเพื่อเข้าใจและให้เหตุผลเกี่ยวกับเสียง ภาพ และฉากซับซ้อนในวิดีโอยาว","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA เปิดตัว Audio-Visual Flamingo: โมเดลภาษาขนาดใหญ่แบบเสียง-ภาพเปิดสำหรับวิดีโอความยาว - ข่าว AI Aioga","description":"NVIDIA เปิดตัว Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo) ซึ่งเป็นโมเดลภาษาขนาดใหญ่แบบเสียง-ภาพที่เปิดโอเพ่นซอร์สอย่างเต็มรูปแบบ ออกแบบมาเพื่อเข้าใจและให้เหตุผลเกี่ยวกับเสีย...","url":"https://www.aioga.com/th/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:12:24.597Z"},"pl":{"title":"NVIDIA wydało Audio-Visual Flamingo: otwarty duży model językowy audio-wizualny do długich wideo","summary":"NVIDIA wprowadza Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), w pełni otwarty model językowy audio-wizualny, zaprojektowany do rozumienia i wnioskowania w zakresie dźwięku, obrazów i złożonych scen w długich wideo.","category":"模型更新","source":"HuggingFace Daily Papers（社区热门论文）","aggregationSource":"HuggingFace Daily Papers（社区热门论文）","pageTitle":"NVIDIA wydało Audio-Visual Flamingo: otwarty duży model językowy audio-wizualny do długich wideo - Aioga Wiadomości AI","description":"NVIDIA wprowadza Nemotron-Labs-Audio-Visual Flamingo (AV-Flamingo), w pełni otwarty model językowy audio-wizualny, zaprojektowany do rozumienia i wnioskowania w zakresie dźwięku, o...","url":"https://www.aioga.com/pl/news/cmrsmh6lu0aj0biwmsi84t57e/","contentTranslated":true,"sourceHash":"e8a32cb0d33d4bee","translatedAt":"2026-07-22T17:13:13.092Z"}}}}