HPD-Parsing utiliza decodificación paralela en capas en lugar de generación autoregresiva completa de la página: la rama de diseño principal coordina la es...
论文研究HuggingFace Daily Papers(社区热门论文)
Resumen diario de inteligencia IA
HPD-Parsing utiliza decodificación paralela en capas en lugar de generación autoregresiva completa
de la página: la rama de diseño principal coordina la estructura global y asigna dinámicamente la decodificación de contenido a nivel de bloque a ramas concurrentes, la predicción progresiva de múltiples tokens (P-MTP) reduce aún más el número de pasos de decodificación en cada rama. En benchmarks públicos, alcanza un rendimiento de 4,752 tokens/s, aumentando 3.06 veces en comparación con la línea base autoregresiva, al mismo tiempo que mantiene una precisión de análisis competitiva. Este enfoque abre una nueva dirección para el análisis de documentos unificado y eficiente.
Artículo y notas de fuente
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
HPD-Parsing utiliza decodificación paralela en capas en lugar de generación autoregresiva completa de la página: la rama de diseño principal coordina la es...