Dots.Ocr
Multilingual Document Layout Parsing in a Single Vision-Language Model
About
dots.ocr Designed for universal accessibility, it possesses the capability to recognize virtually any human script. Beyond achieving state-of-the-art (SOTA) performance in standard multilingual document parsing among models of comparable size, dots.ocr-1.5 excels at converting structured graphics (e.g., charts and diagrams) directly into SVG code, parsing web screens and spotting scene text.
Open Source Health
- Stars
- 9,107
- Forks
- 806
- License
- MIT
- Last commit
- 7 months ago
Resources & Links
Related Categories
Vendor
Dots Studio
Open-source project on GitHub: Dots.Ocr
Quick Links
Open Source
Related Products
OCRmyPDF
OCRmyPDF adds an OCR text layer to scanned PDF files, allowing them to be searched
Top category match
ZenlessZoneZero-Auto
绝区零 | ZenlessZoneZero | 零号空洞 | 自动战斗 | 自动化 | 图片分类 | OCR识别
Top category match
PaddleOCR2Pytorch
PaddleOCR inference in PyTorch. Converted from [PaddleOCR](https://github.com/PaddlePaddle/PaddleOCR)
Top category match
MinerU
A practical document parsing tool for converting PDF, images, DOCX, PPTX, and XLSX into Markdown and JSON
Top category match
Deepseek OCR App
A quick vibe coded app for deepseek OCR
Top category match