본문으로 건너뛰기
← 블로그로 돌아가기
5분 읽기DocCrunch Team

이미지를 Excel로 변환했는데 왜 숫자를 바로 계산할 수 없을까요?

OCR 표의 텍스트 숫자, 앞자리 0, 모호한 날짜, 셀 위치를 확인하고 데이터 형식을 정리한 뒤 수식을 다시 만드는 방법을 살펴봅니다.

이미지를 Excel로 변환표 OCR텍스트로 저장된 숫자Excel 데이터 정리

표 이미지를 Excel로 변환하면 다시 입력하는 시간을 줄일 수 있습니다. 하지만 결과를 계산에 쓸 수 있는지는 열의 정렬, 숫자의 해석, 각 셀에 저장된 데이터 형식에 달려 있습니다.

깔끔한 워크시트에도 텍스트로 저장된 숫자, 잘못된 소수점 위치, 사라진 앞자리 0이 남아 있을 수 있습니다. 읽을 때는 눈에 잘 띄지 않아도 정렬, 필터, 합계에 영향을 줍니다.

숫자를 읽었다고 숫자 형식이 된 것은 아닙니다

이미지에는 문자의 모양만 있고 스프레드시트의 데이터 형식은 없습니다. OCR이 125.50을 읽더라도 그 내용만으로는 금액인지, 식별자인지, 버전 번호인지 알 수 없습니다.

DocCrunch 이미지 Excel 변환은 이미지의 텍스트를 인식해 워크시트로 정리합니다. 현재 내보내는 셀은 숫자처럼 보이는 내용까지 모두 텍스트로 저장됩니다.

따라서 Excel에서 파일을 열고 셀을 수정할 수 있다고 해서 열 전체를 바로 합산할 수 있는 것은 아닙니다. 일부 연산은 텍스트 숫자를 변환하지만, 일부 함수는 이를 무시할 수 있어 결과가 달라질 수 있습니다.

먼저 각 열이 무엇을 뜻하는지 확인하고 필요한 형식으로 변환해야 합니다. 금액과 수량은 대체로 숫자 형식이 필요하지만, 제품 코드, 우편번호, 주문번호는 보통 텍스트로 유지하는 편이 적절합니다.

숫자로 보이는 내용을 전부 숫자 형식으로 바꾸지 마세요

비슷해 보이는 값도 처리 방식은 다릅니다.

인식된 내용 가능한 의미 확인할 점
001204 제품 또는 레코드 식별자 앞자리 0을 유지하도록 보통 텍스트로 저장
1,250.50 금액 쉼표와 마침표의 역할을 확인한 뒤 변환
03/04/2026 날짜 원본이 월/일인지 일/월인지 확인
12% 비율 변환된 값이 12가 아닌 0.12를 나타내는지 확인

여러 언어나 지역의 표에서는 구분 기호를 특히 주의해야 합니다. 1,250은 천이백오십일 수도 있고 일 점 이오영일 수도 있습니다. 셀 하나만 보지 말고 열 제목, 단위, 표 전체의 표기법을 함께 확인해야 합니다.

빈칸도 일괄적으로 0으로 바꾸면 안 됩니다. 빈칸은 미입력, 누락, 해당 없음을 뜻할 수 있지만 0은 명시적인 값입니다. 평균이나 개수 계산에서 다르게 처리될 수 있습니다.

계산 전에 행과 열부터 확인하세요

OCR 오류는 문자에만 생기지 않습니다. 정확히 읽힌 숫자라도 옆 행에 들어가면 데이터의 의미가 달라집니다.

먼저 다음을 확인하세요.

  • 여러 줄로 된 머리글이 데이터 영역에 섞였는지.
  • 긴 이름이 두 개의 레코드로 나뉘었는지.
  • 빈 셀 주변의 값이 왼쪽이나 오른쪽 열로 밀렸는지.
  • 소계, 합계, 각주가 일반 데이터로 들어갔는지.
  • 페이지마다 반복되는 머리글이 표 중간에 남았는지.

같은 행의 이름, 수량, 단가, 금액을 함께 대조해야 합니다. 한 열이 숫자처럼 보이는지만 확인해서는 충분하지 않습니다.

이미지에 무관한 영역이 크게 포함되어 있다면 이미지 자르기로 표 전체가 남도록 정리할 수 있습니다. 다만 머리글, 단위, 필요한 주석은 유지해야 데이터를 해석할 근거가 사라지지 않습니다.

여러 이미지를 한 시트에 넣어도 통합이 끝난 것은 아닙니다

여러 페이지를 촬영한 표에는 서로 다른 열 너비, 반복 머리글, 중간 설명문이 있을 수 있습니다. 하나의 파일로 내보내는 것은 내용을 모으는 단계일 뿐입니다.

DocCrunch는 이미지마다 별도 시트를 만들거나 모든 이미지를 한 시트에 넣을 수 있습니다. 후자는 각 이미지의 내용을 순서대로 추가하고 파일명과 빈 행으로 구분합니다. 열 구조를 자동으로 통일하거나 반복 머리글을 삭제하지는 않습니다.

이미지들이 하나의 연속된 표라면 열 순서를 확인하고 구분 내용을 제거한 뒤 필터와 계산에 사용할 데이터 범위로 정리해야 합니다.

열의 의미가 다르다면 시트를 분리해 두는 편이 편리합니다. 두 열의 이름이 모두 ‘금액’이어도 통화, 단위, 집계 범위가 일치하는지 확인해야 합니다.

이미지에 보이는 결과에는 원래 수식이 없습니다

스크린샷에 240.00이 표시되어 있다면 OCR은 그 결과를 추출합니다. 원래 셀이 곱셈, 조건부 수식, 다른 시트 참조 중 무엇을 사용했는지는 알 수 없습니다.

데이터를 검증한 후 수식을 다시 만드세요. 수량과 단가의 곱, 그룹 소계, 총합은 대조에 도움이 됩니다. 다만 합계가 맞아도 모든 행이 정확하다는 뜻은 아닙니다. 두 오류가 서로 상쇄될 수 있습니다.

원본 스프레드시트가 있다면 우선 사용하세요. 텍스트를 선택할 수 있는 PDF라면 캡처하기 전에 PDF Excel 변환을 시도할 수 있습니다. 스캔된 PDF 페이지는 이미지이므로 OCR이 필요합니다. 현재 DocCrunch의 PDF Excel 변환은 주로 기존 텍스트를 추출하며 스캔을 직접 인식하지 않습니다.

변환 후에는 일정한 순서로 검토하세요

워크시트를 계속 사용하기 전에 다음을 확인하세요.

  1. 원본 이미지와 비교해 레코드 수와 행·열 대응을 확인합니다.
  2. 식별자, 텍스트, 숫자, 날짜를 구분하고 열별로 형식을 정리합니다.
  3. 소수 구분 기호, 단위, 날짜 표기를 통일합니다.
  4. 빈칸, 마이너스 기호, 소수점, 반복 머리글을 확인합니다.
  5. 필요한 수식을 다시 만들고 원본의 소계나 합계와 대조합니다.

이미지 Excel 변환의 가치는 셀을 하나씩 입력하는 일을 검토와 정리로 바꾸는 데 있습니다. 원본 이미지를 참고용으로 보관하고 인식된 데이터의 의미를 분명히 한 뒤 계산에 활용하세요.

추천 DocCrunch 도구

이 도구들은 가능한 경우 브라우저에서 로컬로 실행되며 파일을 서버에 업로드할 필요가 없습니다.