Тематическая подборка
ocr
7 open-source проектов с AI-разборами, метриками и прямыми ссылками на GitHub.
PaddlePaddle/PaddleOCR
PaddleOCR превращает PDF и изображения в структурированные данные для LLM: Markdown, JSON, поддержка 100+ языков.
z15114664687-dot/hr-onboarding-agent
Открытое FastAPI-приложение для адаптации сотрудников в Feishu/Lark с рабочими пространствами, OCR, проверкой документов, синхронизацией и напоминаниями.
mrpulor-gh/nuphus-mcp
MCP-сервер на Rust для управления экраном, окнами, мышью, клавиатурой и Chrome через stdio, с локальным OCR и подключаемым внешним компьютерным зрением.
oxbshw/watch-skill
Локальный слой видеоаналитики для AI-агентов: поиск по видео, распознавание сцен и речи, временные доказательства и проверка результатов через цикл THE LOOP.
linenxi-ctrl/dsh-vision
为 DeepSeek Harness 增加外挂识图模型:圆形鲸鱼按钮、发送图片识图自动回传、模型自主截图+识图工具、多协议自动适配、小白一键安装(未装 Node.js 自动下载)
drpwchen/textbook-to-note
Локальный Python-конвейер превращает PDF и EPUB в структурированные Markdown-заметки с поиском, цитатами, OCR и извлечёнными рисунками.
anshupriyan/Local-Recall
Локальный прототип для захвата экрана, распознавания текста и семантического поиска по истории с помощью SQLite, векторных эмбеддингов и LLM без облака.