Usa un'immagine chiara e ben illuminata per un'estrazione del testo più accurata.
Un'immagine alla volta. Il testo stampato offre i risultati migliori. Impaginazioni complesse, tabelle e scrittura a mano potrebbero non conservare la struttura originale.

Estrai testo da un'immagine

Trasforma immagini JPG, PNG e WebP in testo modificabile in pochi secondi.

Come estrarre testo da un'immagine

  1. 01Scegli un'immagine JPG, PNG o WebP dal tuo dispositivo.
  2. 02Seleziona la lingua usata nell'immagine e ruota l'anteprima se necessario.
  3. 03Estrai il testo, rivedilo, quindi copialo o scarica un file TXT.

Cosa gestisce questo OCR

Lo strumento riconosce testo stampato in inglese, vietnamita, tedesco, olandese, cinese semplificato, giapponese, coreano e arabo. Scansioni chiare e screenshot di solito funzionano meglio di foto sfocate o distorte.

Limiti dell'OCR

L'ordine di lettura può essere imperfetto in pagine a più colonne, tabelle, scrittura a mano e testo fortemente curvo.

Domande sull'OCR delle immagini

Quale qualità dell'immagine produce i risultati OCR migliori?

Il testo stampato chiaro e ad alto contrasto funziona meglio. Usa una sorgente nitida con abbastanza pixel per caratteri piccoli, illuminazione uniforme, compressione limitata e una pagina fotografata il più piatta e dritta possibile. Ritaglia sfondi non correlati e ruota il testo in verticale prima dell'estrazione. Risoluzione molto bassa, mosso, bagliori, ombre, carta strutturata, pagine curve, font decorativi e miglioramento aggressivo dell'immagine possono fondere o rompere le forme dei caratteri. Ingrandire una sorgente genuinamente a bassa risoluzione può aiutare la visibilità, ma non può ricreare dettagli mai catturati.

Perché è importante selezionare la lingua OCR corretta?

La scelta della lingua determina quale modello di riconoscimento e quali modelli di caratteri sono attesi. Selezionare inglese per testo cinese, giapponese, coreano, arabo, vietnamita o tedesco può produrre sostituzioni plausibili ma errate perché alfabeto, accenti, direzione e modelli di parole attesi differiscono. Scegli la lingua dominante visibile nell'immagine. Quando un'immagine mescola più lingue, estrai la sezione più importante separatamente con la lingua corrispondente e confronta attentamente nomi, numeri, date e termini tecnici perché ricevono meno aiuto dai normali modelli linguistici.

Cosa può influenzare l'ordine di lettura rilevato?

L'OCR identifica le regioni di testo e poi le ordina in base alle loro posizioni. Articoli a più colonne, tabelle, barre laterali, moduli, didascalie, testo verticale, etichette curve, timbri sovrapposti e note scritte a mano possono rendere ambigua la sequenza prevista. Ritaglia regioni indipendenti ed estraile separatamente quando l'ordine è importante. Dopo l'estrazione, confronta il risultato con la sorgente dall'alto verso il basso, ripristina le interruzioni di paragrafo e verifica intestazioni, righe di tabella, etichette, note a piè di pagina e testo accanto alle immagini piuttosto che presumere che sia stato ricostruito un layout completo del documento.

L'OCR può preservare tabelle e formattazione del documento?

No. Questo strumento restituisce testo modificabile e regioni rilevate, non una ricreazione Word, foglio di calcolo o PDF ricercabile del design originale. Le colonne possono essere lette in un ordine inaspettato, le celle della tabella possono perdere le relazioni di riga e colonna e font, colore, spaziatura, bordi, immagini e arredi di pagina non sono preservati come layout corrispondente. Usa il risultato per evitare di riscrivere, quindi ricostruisci la struttura richiesta nell'applicazione di destinazione e confronta i valori importanti con la sorgente prima di fare affidamento su di essi.

Perché il tempo di elaborazione OCR può variare?

Il tempo dipende dalle dimensioni dell'immagine, dal numero e dalle dimensioni delle regioni di testo, dalla complessità del layout, dalla lingua selezionata, dalla rotazione e dalle risorse necessarie per preparare il riconoscimento. Una grande fotografia con un piccolo documento al centro può richiedere più lavoro producendo comunque testo peggiore di una scansione ritagliata strettamente. Usa l'immagine chiara più piccola che conserva i caratteri necessari, ritaglia aree irrilevanti ed evita di ingrandire ripetutamente sorgenti già nitide. Tieni la pagina aperta finché non appare un risultato o un errore utile.

Come dovrei verificare il testo OCR estratto?

Confronta nomi, date, indirizzi, totali, separatori decimali, numeri di conto, identificatori, punteggiatura e qualsiasi carattere dove un singolo errore cambia il significato. Confusioni comuni includono zero e O, uno e l minuscola, punteggiatura simile, lettere accentate e caratteri visivamente correlati in scritture CJK o arabe. Rivedi l'ordine delle righe e il testo mancante attorno a immagini o tabelle. Per materiale legale, finanziario, medico, accademico o d'archivio, usa una seconda revisione contro l'immagine originale prima di copiare il risultato in un altro record.