Baidu представила Unlimited-OCR: однопроходный анализ многостраничных документов.
Компания Baidu поделилась новой разработкой в области оптического распознавания символов с большим горизонтом обработки. Модель получила название Unlimited-OCR и предназначена для однопроходного анализа документов.
Ключевые возможности
- парсинг длинных документов, от отдельных изображений до многостраничных PDF;
- работа с разноформатными источниками без дополнительной настройки.
Подробности и техническая документация доступны на GitHub, а опробовать модель в деле можно на платформе Hugging Face.

