GitHub-радар
Разбор документов и таблиц — прямо на своём компьютере
Компактная модель для разбора сканов и фотографий документов извлекает текст и таблицы точнее моделей в разы крупнее себя, а работает на обычном ноутбуке.
TeleOCR — компактная модель для разбора документов. Её выпустила команда XingChen-AGI, раньше модель называлась NaviDC-OCR. Модель обучена читать не только ровные цифровые сканы. Она справляется и с фотографиями документов, снятыми под углом или с перекосом, без отдельной программы выравнивания страницы. TeleOCR распознаёт не только текст, но и структуру — таблицы, формулы, порядок чтения многоколоночной страницы. При размере около 1,2–1,4 миллиарда параметров она набрала на тесте OmniDocBench v1.6 балл 96.87. Это выше, чем у куда более крупных моделей общего назначения, включая Gemini 3 Pro и GPT-5.2. Модель заточена под одну задачу. Она не ведёт диалог и не пишет код — только принимает документ и отдаёт размеченный текст.
Зачем это вайб-кодеру
Вайб-кодеру иногда нужно вытащить текст и таблицу из скана договора, чека или сфотографированной страницы. TeleOCR — готовый локальный инструмент именно под эту задачу, а не повод писать отдельный сервис или платить за облачный OCR. Модель компактная, поэтому её можно держать у себя постоянно и пропускать через неё документы пачками. Для диалога с агентом или написания кода она не подходит — это только извлечение текста и структуры из документа.
Как поставить
Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:
Поставь мне модель для распознавания документов TeleOCR: https://huggingface.co/XingChen-AGI/TeleOCR — подбери способ запустить её у меня на компьютере и покажи, как скормить ей скан документа или фото и получить текст с таблицами.
Обычный ноутбук от 8 ГБ оперативки — сама модель занимает около 1 ГБ.
Открыть на Hugging Face▌ Ещё находки