OpenOCR

Если тебе часто нужно распознавать текст, формулы или таблицы с документов, то OpenOCR — это то, что нужно. Он умеет работать с китайским и английским языками, а ещё отлично справляется с разными форматами, будь то простой текст или сложные формулы.
Это опенсорсный тулкит для General-OCR задач, разработанный командой FVL Lab из Fudan University. В нём есть системы распознавания текста и парсинга документов, которые можно использовать в своих проектах.
Круто, что у OpenOCR есть система OpenDoc-0.1B, которая весит всего 0.1B параметров и при этом обходит многие большие языковые модели в парсинге документов. Это значит, что можно получить высокую точность без огромных ресурсов.
https://github.com/Topdu/OpenOCR | 1427 звёзд
#сервисы


