Адаптивный парсинг PDF с обратной связью от LLM: как дешёвый PyMuPDF, Azure Layout и Vision LLM работают в связке
PyMuPDF извлекает текст за миллисекунды по умолчанию, но ломается на таблицах и диаграммах.
LLM выступает контролёром: анализирует результат дешёвого парсера и выставляет флаг context_structured при рисках.
Проблемные страницы перепарсятся через Azure Layout или Vision LLM — дорого, но только по необходимости.
Stress-тест 18 запусков показал: бинарный вердикт LLM ненадёжен, стабильность даёт чтение текстовой рациональной оценки.
Читать статью →
Подписаться на канал
AiManual - База знаний по ИИ
24 июл 2026 09:22
Комментариев пока нет.