Telegram — лонгриды

OpenOCR

Изображение из Telegram поста
OpenOCR

Если тебе часто нужно распознавать текст, формулы или таблицы с документов, то OpenOCR — это то, что нужно. Он умеет работать с китайским и английским языками, а ещё отлично справляется с разными форматами, будь то простой текст или сложные формулы.

Это опенсорсный тулкит для General-OCR задач, разработанный командой FVL Lab из Fudan University. В нём есть системы распознавания текста и парсинга документов, которые можно использовать в своих проектах.

Круто, что у OpenOCR есть система OpenDoc-0.1B, которая весит всего 0.1B параметров и при этом обходит многие большие языковые модели в парсинге документов. Это значит, что можно получить высокую точность без огромных ресурсов.

https://github.com/Topdu/OpenOCR | 1427 звёзд

#сервисы