Как распознавать документы через OCR с помощью моделей серии Qwen 3.5
Автор прогнал PDF через OCR с помощью открытых мультимодальных моделей серии Qwen 3.5: сначала экспортировал каждую страницу в изображение с разрешением 100 dpi через PyMuPDF, а затем отдал его модели на распознавание. По результатам тестов Qwen3.5-9B — это баланс между качеством и скоростью, а модели поменьше, от 0.8B до 2B, на сложных документах часто сбиваются и начинают пересказывать содержимое.
Почему это важно: Автор протестировал модели Qwen 3.5 разных размеров на OCR для PDF и описал два воспроизводимых пути — локальный и через OpenRouter — вместе с данными о затратах.