RAG에서 향후 PDF 파일을 지원할 예정인가요?

확인했습니다. 며칠만 시간을 주세요. 기본적으로 활성화할 수 있는 직접 텍스트 추출도 시도해 보고 싶습니다.

그 후 "리치"한 LLM 기반 추출은 플래그 뒤에 두겠습니다.

많은 PDF의 문제는 용량이 매우 크고 서버 리소스에 큰 부하를 줄 수 있다는 점입니다. 또한 tesseract와 같은 도구는 설치가 다소 까다로울 수 있지만, 품질을 향상시킬 수 있습니다.

5개의 좋아요