HPD-Parsing은 전체 페이지 자회귀 생성을 대신하여 계층 병렬 디코딩을 사용합니다: 주 레이아웃 분기가 전체 구조를 조정하고 블록 단위 콘텐츠 디코딩을 동시 분기로 동적으로 할당하며, 점진적 다중 토큰 예측(P-MTP)은 각 분기 디코딩 단계를 더욱 줄입니다. 공개 벤치...
论文研究HuggingFace Daily Papers(社区热门论文)
오늘의 AI 정보 요약
HPD-Parsing은 전체 페이지 자회귀 생성을 대신하여 계층 병렬 디코딩을 사용합니다: 주 레이아웃 분기가 전체 구조를 조정하고 블록 단위 콘텐츠 디코딩을 동시 분기로 동적으로
할당하며, 점진적 다중 토큰 예측(P-MTP)은 각 분기 디코딩 단계를 더욱 줄입니다. 공개 벤치마크에서 초당 4,752 토큰의 처리량을 달성하여 자회귀 기준보다 3.06배 향상되었으며, 경쟁력 있는 파싱 정밀도를 유지합니다. 이 방법은 효율적인 통합 문서 파싱에 새로운 방향을 열었습니다.
본문 및 출처 설명
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
HPD-Parsing은 전체 페이지 자회귀 생성을 대신하여 계층 병렬 디코딩을 사용합니다: 주 레이아웃 분기가 전체 구조를 조정하고 블록 단위 콘텐츠 디코딩을 동시 분기로 동적으로 할당하며, 점진적 다중 토큰 예측(P-MTP)은 각 분기 디코딩 단계를 더욱 줄입니다. 공개 벤치...