Извлечь текст из изображения
Превратите изображения JPG, PNG и WebP в редактируемый текст за секунды.
Как извлечь текст из изображения
- 01Выберите изображение JPG, PNG или WebP с вашего устройства.
- 02Выберите язык, используемый на изображении, и при необходимости поверните предпросмотр.
- 03Извлеките текст, проверьте его, затем скопируйте или скачайте файл TXT.
Что обрабатывает этот OCR
Инструмент распознаёт печатный текст на английском, вьетнамском, немецком, нидерландском, упрощённом китайском, японском, корейском и арабском языках. Чёткие сканы и скриншоты обычно работают лучше, чем размытые или искажённые фотографии.
Ограничения OCR
Порядок чтения может быть неточным на многоколоночных страницах, в таблицах, рукописном тексте и сильно искривлённом тексте.
Вопросы об OCR изображений
Какое качество изображения даёт лучшие результаты OCR?
Лучше всего работает чёткий печатный текст с высоким контрастом. Используйте резкий источник с достаточным разрешением для мелких символов, ровным освещением, ограниченным сжатием и страницей, сфотографированной как можно более плоско и прямо. Обрежьте посторонний фон и поверните текст вертикально перед извлечением. Очень низкое разрешение, смазанность движения, блики, тени, текстурированная бумага, изогнутые страницы, декоративные шрифты и агрессивное улучшение изображения могут сливать или ломать формы символов. Увеличение действительно низкоразрешённого источника может помочь видимости, но не может воссоздать детали, которые никогда не были захвачены.
Почему важен правильный выбор языка OCR?
Выбор языка определяет, какая модель распознавания и какие шаблоны символов ожидаются. Выбор английского для китайского, японского, корейского, арабского, вьетнамского или немецкого текста может дать правдоподобные, но неверные замены, поскольку ожидаемые алфавит, акценты, направление и шаблоны слов различаются. Выберите доминирующий язык, видимый на изображении. Если изображение смешивает несколько языков, извлеките наиболее важный раздел отдельно с соответствующим языком и внимательно сравните имена, числа, даты и технические термины, поскольку они получают меньше помощи от обычных языковых шаблонов.
Что может повлиять на обнаруженный порядок чтения?
OCR определяет текстовые области, а затем упорядочивает их по позициям. Многоколоночные статьи, таблицы, боковые панели, формы, подписи, вертикальный текст, изогнутые надписи, перекрывающиеся штампы и рукописные заметки могут сделать предполагаемую последовательность неоднозначной. Обрежьте независимые области и извлекайте их отдельно, когда порядок важен. После извлечения сравните результат с источником сверху вниз, восстановите разрывы абзацев и проверьте заголовки, строки таблиц, подписи, сноски и текст рядом с изображениями, а не предполагайте, что полный макет документа был восстановлен.
Может ли OCR сохранить таблицы и форматирование документа?
Нет. Этот инструмент возвращает редактируемый текст и обнаруженные области, а не воссоздание Word, электронной таблицы или поискового PDF исходного дизайна. Столбцы могут читаться в неожиданном порядке, ячейки таблиц могут терять связи строк и столбцов, а шрифт, цвет, интервалы, границы, изображения и элементы страницы не сохраняются как соответствующий макет. Используйте результат, чтобы избежать повторного набора, затем восстановите необходимую структуру в целевом приложении и сравните важные значения с источником, прежде чем полагаться на них.
Почему время обработки OCR может различаться?
Время зависит от размеров изображения, количества и размера текстовых областей, сложности макета, выбранного языка, поворота и ресурсов, необходимых для подготовки распознавания. Большая фотография с небольшим документом в центре может потребовать больше работы, давая при этом худший текст, чем плотно обрезанный скан. Используйте наименьшее чёткое изображение, сохраняющее нужные символы, обрезайте нерелевантные области и избегайте многократного увеличения уже резких источников. Держите страницу открытой, пока не появится результат или полезная ошибка.
Как следует проверять извлечённый текст OCR?
Сравнивайте имена, даты, адреса, итоги, десятичные разделители, номера счетов, идентификаторы, пунктуацию и любые символы, где одна ошибка меняет смысл. Распространённые путаницы включают ноль и O, единицу и строчную l, похожую пунктуацию, буквы с диакритикой и визуально связанные символы в CJK или арабском письме. Проверяйте порядок строк и отсутствующий текст вокруг изображений или таблиц. Для юридических, финансовых, медицинских, академических или архивных материалов используйте вторую проверку по исходному изображению перед копированием результата в другую запись.