Relation-Rich Visual Document Generator for Visual Information Extraction
Hu et al. [2024]Anwen Hu, Haiyang Xu, Jiabo Ye, Ming Yan, Liang Zhang, Bo Zhang, Ji Zhang, Qin Jin, Fei Huang, and Jingren Zhou.mPLUG-DocOwl 1.5: Unified structure learning for OCR-free document understanding.InFindings of the Association for Computational Linguistics: EMNLP 2024, pages 3096–3120, Miami, Florida, USA, 2024. Asso...