Boogu-Image-0.1 lanzado: Un modelo unificado de comprensión y generación multimodal de código abierto, con un coste de entrenamiento de solo unos 400.000 dólares
La serie Boogu-Image-0.1 es un modelo de código abierto unificado multimodal para comprensión y generación, que presenta cuatro variantes: Base, Turbo, Edi...
模型更新HuggingFace Daily Papers(社区热门论文)
Resumen diario de inteligencia IA
La serie Boogu-Image-0.1 es un modelo de código abierto unificado multimodal para comprensión y
generación, que presenta cuatro variantes: Base, Turbo, Edit y Edit-Turbo. Soporta texto a imagen de alta calidad, razonamiento rápido, edición de instrucciones y renderizado bilingüe chino-inglés.
Artículo y notas de fuente
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
La serie Boogu-Image-0.1 es un modelo de código abierto unificado multimodal para comprensión y generación, que presenta cuatro variantes: Base, Turbo, Edi...