Автоматизация обработки PDF: формы, таблицы, OCR

★ 6.5 · data

pdf-processing-pro — это скилл для Claude Code, который обеспечивает production-ready обработку PDF-файлов с поддержкой форм, таблиц, OCR и массовых операций. В состав входит набор готовых Python-скриптов: analyze_form.py, fill_form.py, extract_tables.py, extract_text.py, merge_pdfs.py, split_pdf.py и другие — каждый с CLI-интерфейсом, валидацией входных данных, настраиваемым логированием и стандартизированными кодами завершения (0–4) для интеграции в автоматизацию. Скилл использует библиотеки pdfplumber, pypdf, pytesseract и pandas; для OCR отсканированных документов требуется системный пакет Tesseract. Подходит разработчикам и дата-инженерам, которым нужно автоматизировать извлечение данных из PDF-отчётов, пакетную обработку счётов или заполнение форм с проверкой данных в production-среде.