PDF 텍스트 추출
PDF 안의 글자를 뽑아 텍스트로 만듭니다.
어디에 쓰나요
PDF 보고서에서 문장을 인용하거나, 표 데이터를 옮기거나, 긴 문서를 검색 가능한 텍스트로 바꿀 때 씁니다. 복사 금지가 걸려 있지 않은 일반 PDF라면 대부분 추출됩니다.
글자가 안 나온다면
스캔한 종이 문서는 겉보기에 글자여도 실제로는 사진이라 추출할 것이 없습니다. 추출 결과가 비었다면 이 경우일 가능성이 높고, 문자 인식(OCR) 기능이 있는 별도 프로그램이 필요합니다. 이 도구는 OCR을 하지 않습니다.
줄바꿈과 표
글자의 세로 위치를 기준으로 줄을 나눕니다. 일반 문서는 잘 나오지만, 여러 단으로 나뉜 편집물이나 표는 순서가 뒤섞일 수 있습니다. 표 데이터가 목적이라면 추출 후 텍스트 정리로 다듬는 편이 빠릅니다.
처리 방식
파일은 업로드되지 않고 브라우저 안에서 해석됩니다. 계약서나 내부 문서를 다뤄도 밖으로 나가지 않습니다.