PDFIntact

PDF에서 표와 본문을 그대로 꺼냅니다

스캔한 PDF는 글자를 선택·복사할 수 없습니다

복합기로 스캔한 문서에서 글자를 선택하려 해도 아무 일도 일어나지 않습니다. 검색해도 걸리지 않습니다. 끌면 단어가 아니라 사각형이 선택됩니다.

그 파일이 종이의 이미지일 뿐이기 때문입니다. 스캐너는 페이지가 어떻게 보이는지를 저장합니다. 사람 눈에는 글자지만 파일 안에서는 사진과 다를 바 없습니다. 문자 데이터가 아예 없으므로 선택할 것도 복사할 것도 검색할 것도 없습니다.

꺼내려면 이미지에서 글자를 읽어 내야 합니다. 흐린 인쇄, 기울어짐, 낮은 해상도는 읽을 수 없는 부분을 만듭니다. PDFIntact는 그런 곳을 비워 두지 않고 읽기 불가로 표시합니다. 조용히 채워 넣는 편이야말로 잘못을 눈치챌 수 없게 만들기 때문입니다.

지금 시도

가지고 계신 PDF로 확인해 보세요

진단은 브라우저 안에서만 이루어집니다. 파일은 어디로도 전송되지 않으며 가입도 필요 없습니다. 몇 페이지, 표와 그림이 몇 개나 나오는지 결제 전에 확인할 수 있습니다.

실례

まず見分けてください

同じ「PDF」でも、原因によって対処が変わります。次のどれに当てはまるかで判断できます。

文字を選択できない・検索しても出てこない
スキャンPDF(画像)です。このページの対象です。
選択もコピーもできるが、貼り付けると読めない文字になる
画像ではなく、フォントの対応表が欠けている状態です。PDFをコピーすると文字化けする をご覧ください。
文字は取り出せるが、表の行と列がずれる
PDFが表の構造を持っていないためです。PDFの表をExcelに貼り付けるとずれる をご覧ください。

자주 묻는 질문

스캔한 PDF는 왜 글자를 복사할 수 없나요?
PDF 안에 문자 데이터가 아니라 페이지를 찍은 사진이 들어 있기 때문입니다. 사람 눈에는 글자로 보이지만 파일에게는 그림이므로 선택할 것도 검색할 것도 없습니다.
선택할 수 있게 하려면 어떻게 하나요?
이미지에서 글자를 인식해야 합니다. PDFIntact는 각 페이지를 분석해 본문·표·그래프를 Excel·Word·Markdown·JSON으로 내보냅니다. 결제 전에 브라우저에서 자신의 파일을 읽을 수 있는지 확인할 수 있습니다.
손글씨도 읽을 수 있나요?
손글씨만으로 이루어진 문서는 대상이 아닙니다. 인쇄된 글자가 중심인 문서에 사용해 주세요. 무엇을 변환할 수 없는지는 구매 전 진단에서 알려 드립니다.
스캔 문서의 표도 뽑아낼 수 있나요?
가능합니다. 괘선과 병합 셀까지 재현합니다. 인쇄가 흐리거나 기울어졌거나 해상도가 낮으면 읽지 못하는 부분이 생기는데, 그런 곳은 추측하지 않고 읽기 불가로 보고합니다.
보낸 파일은 어떻게 되나요?
진단은 브라우저 안에서만 이루어지며 원본은 전송하지 않습니다. 변환을 위해 보낸 PDF는 24시간 이내에 삭제하고, 설계상 결제가 완료되기 전에는 아무것도 서버에 올라가지 않습니다.

다른 증상도 한 번에 진단하기내보내기 형식의 차이