PDFIntact

PDF에서 표와 본문을 그대로 꺼냅니다

시험성적서와 검사보고서 PDF의 표를 원본과 대조할 수 있는 형태로 엑셀에 추출하기

시험성적서 PDF 데이터를 엑셀로 옮기는 방법

시험성적서, 검사보고서와 분석증명서 PDF의 측정값을 시료 번호, 단위, 시험 조건, 한정 기호와 원본 페이지를 잃지 않고 엑셀로 옮기는 절차입니다.

PDFIntact 편집팀게시일

맥락이 빠진 측정값은 다시 쓰기 어렵습니다

시험성적서, 검사보고서 또는 분석증명서(CoA)에서 결과는 측정값 하나로 끝나지 않습니다. 어느 시료를 어떤 조건에서 시험했는지, 어떤 규격을 적용했고 단위는 무엇인지도 알아야 합니다. 숫자 열만 복사하면 빠르기는 하지만 안전하게 검증하거나 집계하기 어려운 엑셀 파일이 됩니다.

추출하기 전에 엑셀 열을 정의하세요. 문서에 따라 다음 항목이 필요합니다.

  • 시료명, 배치 번호 또는 로트 번호
  • 시험 항목 또는 분석 대상
  • 측정 결과
  • 단위
  • 규격 또는 허용 범위
  • 적합·부적합 판정
  • 시험 조건
  • 원본 PDF 페이지

공통 단위나 시험 조건처럼 표 밖에 인쇄된 정보도 해당되는 모든 엑셀 행에서 추적할 수 있어야 합니다.

PDF 내용을 세 종류로 나누세요

1. 보고서 공통 정보

성적서 번호, 발행일, 의뢰자, 시료명 같은 정보는 문서 전체 또는 한 페이지에 적용될 수 있습니다. 표 셀 안에 없더라도 결과를 식별하는 데 꼭 필요할 수 있습니다.

2. 표 형식의 결과

시험 항목, 규격, 측정 결과와 판정은 행과 열의 관계에 따라 의미가 결정됩니다. 단순한 문자열 나열이 아니라 구조화된 셀로 추출해야 합니다.

3. 한정 기호와 예외 사항

검출한계 미만, 추정값, 재시험, 측정 불가 같은 표현을 빈 셀이나 0으로 바꾸면 안 됩니다. 원문에 쓰인 한정 기호나 비고를 별도의 열에 보존하세요.

PDF를 엑셀로 옮기는 단계별 절차

1단계: 대상 페이지와 표를 정합니다

목차와 부록이 포함된 PDF에는 비슷한 표가 반복될 수 있습니다. 변환 전에 각 표의 페이지 번호와 제목을 목록으로 만드세요. 시험 항목 이름이 같더라도 시료나 시험 조건이 다르면 별도의 표로 다룹니다.

2단계: 다단계 머리글을 확인합니다

일부 보고서는 위쪽 머리글에 시험 분류를 놓고 그 아래에 개별 항목을 배치합니다. 병합된 상위 셀이 각 하위 열의 의미를 결정합니다. 셀 병합을 해제하기 전에 해당 상위 값을 모든 하위 열에 복사하세요.

세로로 병합된 시료명도 같은 주의가 필요합니다. 엑셀의 빈 셀을 무조건 위의 값으로 채우지 말고, 뒤따르는 행이 실제로 같은 시료에 속하는지 먼저 확인합니다.

3단계: 가공하지 않은 원문을 보존합니다

<0.01, N.D., , 적합은 일반 숫자가 아닙니다. 뜻을 해석하기 전에 기호를 제거하면 정보가 손실될 수 있습니다.

원시 데이터 시트에는 추출된 문자열을 바꾸지 않고 보관하세요. 표준화와 숫자 변환 규칙은 별도의 작업 시트에 적용하고 문서화합니다. 원문과 처리값을 함께 두면 나중에 변환 과정을 감사할 수 있습니다.

4단계: 다음 페이지의 표와 이어지는지 판단합니다

연속되는 페이지에는 열 머리글이 반복되는 경우가 많습니다. 추출된 두 구간을 합치기 전에 다음 신호를 모두 확인하세요.

  • 표 제목 또는 번호가 같습니다.
  • 열 개수와 머리글 이름이 같습니다.
  • 앞 페이지의 마지막 행과 다음 페이지의 첫 행이 논리적으로 이어집니다.
  • 다른 시료나 시험 조건으로 바뀌지 않았습니다.

신호가 맞지 않으면 하나의 표로 억지로 합치지 말고 다른 시트에 보관합니다.

5단계: 원본 PDF와 대조합니다

확인하기 쉬운 값만 고르지 말고 다음 항목을 포함하세요.

  1. 첫 번째와 마지막 데이터 행
  2. 소수 자릿수가 많은 값
  3. 숫자 0과 알파벳 O가 함께 들어간 식별자
  4. 음수, 미만 기호와 범위 값
  5. 주석 표시나 한정 기호가 있는 결과
  6. 페이지가 바뀌기 직전과 직후의 행

원본 표에 합계가 있으면 다시 계산하되, 합계 일치만으로 전체가 정확하다고 판단하지 마세요. 개별 값이 잘못된 행이나 열에 배치됐을 수 있습니다.

원시 데이터와 가공 데이터를 분리하세요

세 개의 시트로 구성하면 추적이 쉬워집니다.

시트 내용
원시 데이터 변경하지 않은 추출 표와 문자열
가공 데이터 표준화한 머리글, 분리한 단위와 해석한 숫자 값
출처 정보 원본 파일명, 페이지, 변환일, 검토자와 알려진 문제

원본 PDF는 엑셀 파일과 별도로 보관하고 같은 성적서 번호나 문서 번호로 연결하세요. 개정된 보고서가 들어왔을 때도 어떤 PDF 버전에서 각 파일이 만들어졌는지 구분할 수 있습니다.

추출은 자동화하되 해석 기준은 기록하세요

행과 열의 감지, 반복 머리글 판별과 엑셀 내보내기는 자동화할 수 있습니다. 하지만 두 구간을 한 표로 볼지, 검출한계 미만 값을 어떻게 집계할지, 참고 결과와 최종 결과를 함께 다룰지는 이후 용도에 따라 달라지므로 명시적으로 기록해야 합니다.

PDFIntact 무료 진단은 원본 파일을 업로드하지 않고 브라우저에서 페이지 수, 텍스트 레이어 상태와 감지된 표·그림 수를 알려 줍니다. 최종 엑셀의 행, 열 또는 값까지 검증하지는 않습니다. 보고나 분석에 쓰기 전에 변환된 엑셀과 원본 PDF를 반드시 대조하세요.

원본을 올리지 않고 확인

변환 전에 이 PDF의 구조를 먼저 확인하세요

무료 진단은 브라우저에서 실행되며 원본 파일은 업로드되지 않습니다.

시험성적서 PDF를 무료로 확인하기