AIPython★ 1,597
enoch3712/ExtractThinker
EXTRACTTHINKER ИНТЕЛЛЕКТ ДОКУМЕНТОВ
ExtractThinker — библиотека для работы с документами в стиле ORM, предназначенная для интеграции с LLM. Она упрощает парсинг, анализ и обработку изображений и текста, предоставляя инструменты для построения рабочих процессов с документами.
// КЛЮЧЕВЫЕ ОСОБЕННОСТИ
- ORM‑подобный API для удобного доступа к документам как к объектам базы данных.
- Парсит PDF, DOCX, изображения и извлекает текст, таблицы и метаданные.
- Выполняет анализ layout и OCR, распознавая структуру документов и рукописный ввод.
- Позволяет строить пайплайны обработки документов с интеграцией в LLM‑цепочки (LangChain).
#ai#document-image-analysis#document-intelligence#document-parsing#document-processing#langchain#llm#machine-learning#nlp#ocr#openai#pdf
Открыть на GitHub →Новые репозитории каждые 30 минут
REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.
Подписаться в Telegram