R_REDDYX.XYZ
AIPython203

iamarunbrahma/pdf-to-markdown

PDF В MARKDOWN БЕЗ ЛИШНЕГО

Проект pdf-to-markdown преобразует PDF‑файлы в чистый Markdown, сохраняя заголовки, списки, таблицы и изображения. Он работает как CLI‑утилита и как импортируемый Python‑модуль, поддерживая обработку и настройку вывода.

// КЛЮЧЕВЫЕ ОСОБЕННОСТИ

  • Извлекает заголовки, списки и таблицы в Markdown, сохраняя исходную иерархию документа
  • Сохраняет изображения как файлы PNG/JPEG со ссылками в Markdown
  • Преобразует PDF, сохраняя структуру разделов и номера страниц в метаданных Markdown
  • Доступен как CLI‑команда pdf2md и как импортируемый Python‑модуль для интеграции в скрипты
#document-conversion#document-processing#information-retrieval#pdf-converter#pdf-extraction#pdf-parsing#pdf-to-markdown#python#rag#retrieval-augmented-generation#text-extraction
Открыть на GitHub →

Новые репозитории каждые 30 минут

REDDYX AI сканирует GitHub 24/7 и присылает лучшие AI/ML/Web3 проекты в Telegram.

Подписаться в Telegram
← Весь каталог

// ПОХОЖИЕ РЕПОЗИТОРИИ

Claw Code: Быстрый код192068Автоматизация процессов n8n187437DeepSeek Плагин Фреймворк186631Оптимизация агентского ИИ186627AutoGPT: AI-агент184170Всё для Claude Code179304

← ВЕСЬ КАТАЛОГ

iamarunbrahma/pdf-to-markdown — PDF В MARKDOWN БЕЗ ЛИШНЕГО…