Usa una imagen clara y bien iluminada para una extracción de texto más precisa.
Una imagen a la vez. El texto impreso funciona mejor. Los diseños complejos, las tablas y la escritura a mano pueden no conservar su estructura original.

Extraer texto de una imagen

Convierte imágenes JPG, PNG y WebP en texto editable en segundos.

Cómo extraer texto de una imagen

  1. 01Elija una imagen JPG, PNG o WebP de su dispositivo.
  2. 02Seleccione el idioma utilizado en la imagen y rote la vista previa si es necesario.
  3. 03Extraiga el texto, revíselo y luego cópielo o descargue un archivo TXT.

Qué maneja este OCR

La herramienta reconoce texto impreso en inglés, vietnamita, alemán, neerlandés, chino simplificado, japonés, coreano y árabe. Los escaneos claros y las capturas de pantalla suelen funcionar mejor que las fotos borrosas o distorsionadas.

Limitaciones del OCR

El orden de lectura puede ser imperfecto en páginas de varias columnas, tablas, escritura a mano y texto muy curvado.

Preguntas sobre OCR de imágenes

¿Qué calidad de imagen produce mejores resultados de OCR?

El texto impreso claro y de alto contraste funciona mejor. Utilice una fuente nítida con suficientes píxeles para caracteres pequeños, iluminación uniforme, compresión limitada y una página fotografiada lo más plana y recta posible. Recorte los fondos irrelevantes y gire el texto verticalmente antes de la extracción. La resolución muy baja, el desenfoque de movimiento, el deslumbramiento, las sombras, el papel texturizado, las páginas curvadas, las fuentes decorativas y la mejora agresiva de la imagen pueden fusionar o romper las formas de los caracteres. Ampliar una fuente genuinamente de baja resolución puede ayudar a la visibilidad, pero no puede recrear detalles que nunca se capturaron.

¿Por qué es importante seleccionar el idioma correcto del OCR?

La elección del idioma determina qué modelo de reconocimiento y patrones de caracteres se esperan. Seleccionar inglés para texto chino, japonés, coreano, árabe, vietnamita o alemán puede producir sustituciones plausibles pero incorrectas porque el alfabeto esperado, los acentos, la dirección y los patrones de palabras difieren. Elija el idioma dominante visible en la imagen. Cuando una imagen mezcla varios idiomas, extraiga la sección más importante por separado con su idioma correspondiente y compare cuidadosamente nombres, números, fechas y términos técnicos, ya que reciben menos ayuda de los patrones de lenguaje ordinarios.

¿Qué puede afectar el orden de lectura detectado?

El OCR identifica regiones de texto y luego las ordena según sus posiciones. Los artículos de varias columnas, tablas, barras laterales, formularios, leyendas, texto vertical, etiquetas curvas, sellos superpuestos y notas escritas a mano pueden hacer que la secuencia prevista sea ambigua. Recorte las regiones independientes y extráigalas por separado cuando el orden sea importante. Después de la extracción, compare el resultado con la fuente de arriba a abajo, restaure los saltos de párrafo y verifique los encabezados, las filas de tablas, las etiquetas, las notas al pie y el texto que se encuentra junto a las imágenes, en lugar de asumir que se reconstruyó un diseño de documento completo.

¿Puede el OCR conservar tablas y formato de documentos?

No. Esta herramienta devuelve texto editable y regiones detectadas, no una recreación en Word, hoja de cálculo o PDF de búsqueda del diseño original. Las columnas pueden leerse en un orden inesperado, las celdas de las tablas pueden perder las relaciones de filas y columnas, y la fuente, el color, el espaciado, los bordes, las imágenes y los elementos de la página no se conservan como un diseño coincidente. Utilice el resultado para evitar volver a escribir, luego reconstruya la estructura requerida en la aplicación de destino y compare los valores importantes con la fuente antes de confiar en ellos.

¿Por qué puede variar el tiempo de procesamiento del OCR?

El tiempo depende de las dimensiones de la imagen, el número y tamaño de las regiones de texto, la complejidad del diseño, el idioma seleccionado, la rotación y los recursos necesarios para preparar el reconocimiento. Una fotografía grande con un documento pequeño en el centro puede requerir más trabajo y aun así producir un texto peor que un escaneo recortado. Utilice la imagen clara más pequeña que conserve los caracteres necesarios, recorte las áreas irrelevantes y evite ampliar repetidamente fuentes ya nítidas. Mantenga la página abierta hasta que aparezca un resultado o un error útil.

¿Cómo debo verificar el texto extraído por OCR?

Compare nombres, fechas, direcciones, totales, separadores decimales, números de cuenta, identificadores, puntuación y cualquier carácter donde un solo error cambie el significado. Las confusiones comunes incluyen cero y O, uno y l minúscula, puntuación similar, letras acentuadas y caracteres visualmente relacionados en escrituras CJK o árabe. Revise el orden de las líneas y el texto faltante alrededor de imágenes o tablas. Para material legal, financiero, médico, académico o de archivo, utilice una segunda revisión contra la imagen original antes de copiar el resultado en otro registro.