Boogu-Image-0.1 rilasciato: Un modello di comprensione e generazione multimodale unificata open-source, con un costo di addestramento di soli circa 400.000 dollari
La serie Boogu-Image-0.1 è un modello open source unificato di comprensione e generazione multimodale, che presenta quattro varianti: Base, Turbo, Edit e E...
模型更新HuggingFace Daily Papers(社区热门论文)
Brief quotidiano sull’IA
La serie Boogu-Image-0.1 è un modello open source unificato di comprensione e generazione
multimodale, che presenta quattro varianti: Base, Turbo, Edit e Edit-Turbo. Supporta testo-immagine di alta qualità, ragionamento rapido, editing delle istruzioni e rendering bilingue cinese-inglese.
Estratto dell’articolo originale
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
La serie Boogu-Image-0.1 è un modello open source unificato di comprensione e generazione multimodale, che presenta quattro varianti: Base, Turbo, Edit e E...