MonkeyOCRv2: A Visual Text Foundation Model for Document AI News 2026.07.24 ⚡ We released MonkeyOCRv2 B Parsing DFlash, enabling vLLM serving with DFlash for up to 2× faster inference. 2026.07.22 🏆 MonkeyOCRv2 B Parsing ranks 1 among evaluated open source models on the official MDPBench Leaderboard, achieving 83.3 overall across 17 languages, including digital born and photographed documents. 2026.07.21 📦 We release MonkeyDoc v2, an open multilingual corpus for document oriented pretraining. We hope it can serve as a shared data foundation for more transparent, reproducible, and fair comparisons in Document AI. 2026.07.14 🚀 We release MonkeyOCRv2, including MonkeyOCRv2 vision encoder, MonkeyOCRv2 Parsing for multilingual document parsing, MonkeyOCRv2 Und for efficient document understanding. Use MonkeyOCRv2 as a Vision Backbone MonkeyOCRv2 is released as a standalone, document native vision encoder. It can be integrated into different OCR and document AI systems as a visual backbone. The current release has been evaluated on document parsing, document understanding, text recognition, formula recognition, text detection, document tampering detection, and overlapping text segmenta…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy