чем сейчас лучше парсить PDF для RAG?
я импользую llama_index (PDFParser)
я получаю странный вывод если в документе (который оригинально гугл док) каждое слово из блока с буллет поинтом выводится на новой строке да еще и пустая строка между словами
text
and
visual
segments,
then
applies
classification
хотя в документе там
text and visual segments, then applies classification