GLM-OCR: лёгкая модель для анализа сложных документов
https://youtu.be/zyeu4g2CBvw?list=TLGGkm3EqYSoKLExNTAyMjAyNg Команда GLM выпустила новую компактную и эффективную модель GLM-OCR, предназначенную для распознавания текста в документах со сложной структурой. Этот инструмент с открытым исходным кодом весит всего 2,65 ГБ и демонстрирует высокую скорость работы даже на стандартном оборудовании. Модель успешно справляется с извлечением данных из таблиц, математических формул, рукописного текста и преобразованием информации в структурированный формат JSON. Несмотря на отличную производительность, текущая версия имеет ограничения, так как поддерживает только английский и китайский языки. Архитектура решения базируется на сочетании визуального энкодера и текстового декодера, что обеспечивает точность без чрезмерных затрат вычислительных ресурсов.
Название:
GLM-OCR: лёгкая модель для анализа сложных документов
Категория:
Разное