Nanjing Üniversitesi ve Alibaba ekibi, nedensel açıklanabilirlik çerçevesi önerdi ve Diffusion Transformer (DiT) içindeki sohbet şablonlarından gelen yapıs...
论文研究HuggingFace Daily Papers(社区热门论文)
Bugünün AI bilgi özeti
Nanjing Üniversitesi ve Alibaba ekibi, nedensel açıklanabilirlik çerçevesi önerdi ve Diffusion
Transformer (DiT) içindeki sohbet şablonlarından gelen yapısal tokenların ipucu anlamı içermemesine rağmen, görüntüden metne dikkat toplama noktası haline geldiğini ve nesne kimliğini nedensel olarak koruduğunu, dolaylı anlam kaydedici işlevi gördüğünü keşfetti.
Orijinal makale alıntısı
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
Nanjing Üniversitesi ve Alibaba ekibi, nedensel açıklanabilirlik çerçevesi önerdi ve Diffusion Transformer (DiT) içindeki sohbet şablonlarından gelen yapıs...