R_REDDYX.XYZ
AIPython1,597

enoch3712/ExtractThinker

EXTRACTTHINKER ИНТЕЛЛЕКТ ДОКУМЕНТОВ

ExtractThinker — библиотека для работы с документами в стиле ORM, предназначенная для интеграции с LLM. Она упрощает парсинг, анализ и обработку изображений и текста, предоставляя инструменты для построения рабочих процессов с документами.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • ORM‑подобный API для удобного доступа к документам как к объектам базы данных.
  • Парсит PDF, DOCX, изображения и извлекает текст, таблицы и метаданные.
  • Выполняет анализ layout и OCR, распознавая структуру документов и рукописный ввод.
  • Позволяет строить пайплайны обработки документов с интеграцией в LLM‑цепочки (LangChain).
#ai#document-image-analysis#document-intelligence#document-parsing#document-processing#langchain#llm#machine-learning#nlp#ocr#openai#pdf
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

enoch3712/ExtractThinker — EXTRACTTHINKER ИНТЕЛЛЕКТ…