Boogu-Image-0.1 lançado: Um modelo unificado de compreensão e geração multimodal de código aberto, com custo de treinamento de apenas cerca de $400.000
A série Boogu-Image-0.1 é um modelo de código aberto unificado multimodal para compreensão e geração, apresentando quatro variantes: Base, Turbo, Edit e Ed...
模型更新HuggingFace Daily Papers(社区热门论文)
Resumo diário de inteligência em IA
A série Boogu-Image-0.1 é um modelo de código aberto unificado multimodal para compreensão e
geração, apresentando quatro variantes: Base, Turbo, Edit e Edit-Turbo. Suporta texto para imagem de alta qualidade, raciocínio rápido, edição de instruções e renderização bilíngue de texto chinês-inglês.
Trecho do artigo original
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
A série Boogu-Image-0.1 é um modelo de código aberto unificado multimodal para compreensão e geração, apresentando quatro variantes: Base, Turbo, Edit e Ed...