선명하고 밝은 이미지를 사용하면 텍스트를 더 정확하게 추출할 수 있습니다.
한 번에 이미지 한 장을 처리합니다. 인쇄된 텍스트에서 가장 잘 작동합니다. 복잡한 레이아웃, 표, 손글씨는 원래 구조가 유지되지 않을 수 있습니다.

이미지에서 텍스트 추출

JPG, PNG, WebP 이미지에서 문자를 인식해 편집 가능한 텍스트로 추출하고, 결과를 검토한 뒤 복사하거나 텍스트 파일로 다운로드하세요.

이미지에서 텍스트를 추출하는 방법

  1. 01기기에서 JPG, PNG 또는 WebP 이미지를 선택합니다.
  2. 02이미지에 사용된 언어를 선택하고 필요하면 미리 보기를 회전합니다.
  3. 03텍스트를 추출하고 확인한 뒤 복사하거나 TXT 파일로 다운로드합니다.

이 OCR이 처리할 수 있는 내용

영어, 베트남어, 독일어, 네덜란드어, 중국어 간체, 일본어, 한국어, 아랍어 인쇄 텍스트를 인식합니다. 흐리거나 왜곡된 사진보다 선명한 스캔과 스크린샷에서 더 잘 작동합니다.

OCR 제한 사항

다단 문서, 표, 손글씨, 심하게 휜 텍스트는 읽기 순서가 부정확할 수 있습니다.

이미지 OCR 질문

어떤 이미지 품질이 더 나은 OCR 결과를 생성합니까?

선명하고 고대비로 인쇄된 텍스트가 가장 좋습니다. 작은 문자, 균일한 조명, 제한된 압축 및 가능한 한 평평하고 직선으로 촬영된 페이지에 대해 충분한 픽셀이 있는 선명한 소스를 사용하십시오. 관련 없는 배경을 자르고 추출하기 전에 텍스트를 수직으로 회전합니다. 매우 낮은 해상도, 모션 블러, 눈부심, 그림자, 질감이 있는 종이, 곡선 페이지, 장식 글꼴 및 공격적인 이미지 향상으로 인해 문자 모양이 병합되거나 깨질 수 있습니다. 실제 저해상도 소스를 확대하면 가시성에 도움이 될 수 있지만 캡처되지 않은 세부 사항을 재현할 수는 없습니다.

올바른 OCR 언어를 선택하는 것이 왜 중요한가요?

언어 선택에 따라 예상되는 인식 모델과 문자 패턴이 결정됩니다. 중국어, 일본어, 한국어, 아랍어, 베트남어 또는 독일어 텍스트에 대해 영어를 선택하면 예상되는 알파벳, 악센트, 방향 및 단어 패턴이 다르기 때문에 그럴듯하지만 잘못된 대체가 생성될 수 있습니다. 이미지에 보이는 주요 언어를 선택하세요. 하나의 이미지에 여러 언어가 혼합되어 있는 경우 가장 중요한 부분을 일치하는 언어로 별도로 추출하고 이름, 숫자, 날짜 및 기술 용어는 일반적인 언어 패턴에 비해 도움을 덜 받기 때문에 신중하게 비교하십시오.

감지된 읽기 순서에 영향을 줄 수 있는 것은 무엇입니까?

OCR은 텍스트 영역을 식별한 다음 해당 위치에서 순서를 지정합니다. 여러 열로 구성된 기사, 표, 사이드바, 양식, 캡션, 세로 텍스트, 곡선 레이블, 겹치는 스탬프 및 손으로 쓴 메모는 의도한 순서를 모호하게 만들 수 있습니다. 독립적인 영역을 자르고 순서가 중요한 경우 별도로 추출합니다. 추출 후에는 전체 문서 레이아웃이 재구성되었다고 가정하기보다는 결과를 소스와 위에서 아래로 비교하고, 단락 나누기를 복원하고, 제목, 표 행, 레이블, 각주 및 이미지 옆에 있는 텍스트를 확인합니다.

OCR은 테이블과 문서 형식을 보존할 수 있습니까?

아니요. 이 도구는 원본 디자인의 Word, 스프레드시트 또는 검색 가능한 PDF 재현이 아닌 편집 가능한 텍스트와 감지된 영역을 반환합니다. 열을 예상치 못한 순서로 읽을 수 있고, 표 셀이 행과 열 관계를 잃을 수 있으며, 글꼴, 색상, 간격, 테두리, 이미지 및 페이지 가구가 일치하는 레이아웃으로 유지되지 않습니다. 결과를 사용하여 재입력을 방지한 다음 대상 애플리케이션에서 필요한 구조를 다시 빌드하고 중요한 값을 소스와 비교한 후 이를 사용하십시오.

OCR 처리 시간이 왜 다를 수 있나요?

시간은 이미지 크기, 텍스트 영역 수 및 크기, 레이아웃 복잡성, 선택한 언어, 회전, 인식 준비에 필요한 리소스에 따라 달라집니다. 중앙에 작은 문서가 있는 큰 사진은 더 많은 작업이 필요할 수 있지만 촘촘하게 자른 스캔보다 더 나쁜 텍스트를 생성할 수 있습니다. 필요한 문자를 유지하는 가장 작고 선명한 이미지를 사용하고, 관련 없는 영역을 자르고, 이미 선명한 소스를 반복적으로 확대하지 마십시오. 결과나 유용한 오류가 나타날 때까지 페이지를 열어 두십시오.

추출된 OCR 텍스트를 어떻게 확인해야 합니까?

이름, 날짜, 주소, 합계, 소수 구분 기호, 계좌 번호, 식별자, 구두점 및 단일 실수로 의미가 바뀌는 모든 문자를 비교합니다. 일반적인 혼동에는 0과 O, 1과 소문자 l, 유사한 구두점, 악센트 문자, CJK 또는 아랍어 스크립트의 시각적으로 관련된 문자 등이 포함됩니다. 이미지나 표 주변의 줄 순서와 누락된 텍스트를 검토하세요. 법률, 금융, 의학, 학술 또는 보관 자료의 경우 결과를 다른 기록에 복사하기 전에 원본 이미지에 대해 두 번째 검토를 사용하십시오.