Tekst uit een afbeelding halen
Zet JPG-, PNG- en WebP-afbeeldingen binnen enkele seconden om in bewerkbare tekst.
Tekst uit een afbeelding halen
- 01Kies een JPG-, PNG- of WebP-afbeelding op je apparaat.
- 02Kies de taal in de afbeelding en draai het voorbeeld indien nodig.
- 03Haal de tekst op, controleer hem en kopieer hem of download een TXT-bestand.
Wat deze OCR herkent
Het hulpmiddel herkent gedrukte tekst in het Engels, Vietnamees, Duits, Nederlands, vereenvoudigd Chinees, Japans, Koreaans en Arabisch. Duidelijke scans en screenshots werken meestal beter dan wazige of vervormde foto's.
OCR-beperkingen
De leesvolgorde kan onjuist zijn bij meerdere kolommen, tabellen, handschrift en sterk gebogen tekst.
Vragen over afbeeldings-OCR
Welke beeldkwaliteit levert betere OCR-resultaten op?
Duidelijke, contrastrijke tekst werkt het beste. Gebruik een scherpe bron met voldoende pixels voor kleine karakters, gelijkmatige belichting, beperkte compressie en een pagina die zo vlak en recht mogelijk is gefotografeerd. Snijd niet-gerelateerde achtergronden bij en draai de tekst rechtop voordat deze wordt geëxtraheerd. Zeer lage resolutie, bewegingsonscherpte, schittering, schaduwen, structuurpapier, gebogen pagina's, decoratieve lettertypen en agressieve beeldverbetering kunnen tekenvormen samenvoegen of breken. Het vergroten van een bron met een werkelijk lage resolutie kan de zichtbaarheid ten goede komen, maar kan geen details reproduceren die nooit zijn vastgelegd.
Waarom is het belangrijk om de juiste OCR-taal te selecteren?
De taalkeuze bepaalt welk herkenningsmodel en karakterpatronen worden verwacht. Het selecteren van Engels voor Chinese, Japanse, Koreaanse, Arabische, Vietnamese of Duitse tekst kan plausibele maar onjuiste vervangingen opleveren, omdat het verwachte alfabet, de accenten, de richting en de woordpatronen verschillen. Kies de dominante taal die zichtbaar is in de afbeelding. Wanneer een afbeelding verschillende talen combineert, extraheer dan het belangrijkste gedeelte afzonderlijk met de overeenkomende taal en vergelijk namen, nummers, datums en technische termen zorgvuldig omdat ze minder hulp krijgen van gewone taalpatronen.
Wat kan de gedetecteerde leesvolgorde beïnvloeden?
OCR identificeert tekstgebieden en rangschikt ze vervolgens vanuit hun posities. Artikelen met meerdere kolommen, tabellen, zijbalken, formulieren, bijschriften, verticale tekst, gebogen labels, overlappende stempels en handgeschreven notities kunnen de beoogde volgorde dubbelzinnig maken. Snijd onafhankelijke regio's bij en extraheer ze afzonderlijk als de volgorde ertoe doet. Na de extractie vergelijkt u het resultaat met de bron van boven naar beneden, herstelt u de alinea-einden en verifieert u koppen, tabelrijen, labels, voetnoten en tekst die naast afbeeldingen staat, in plaats van aan te nemen dat een volledige documentlay-out is gereconstrueerd.
Kan OCR tabellen en documentopmaak behouden?
Nee. Deze tool retourneert bewerkbare tekst en gedetecteerde gebieden, geen Word-, spreadsheet- of doorzoekbare PDF-reconstructie van het oorspronkelijke ontwerp. Kolommen kunnen in een onverwachte volgorde worden gelezen, tabelcellen kunnen rij- en kolomrelaties verliezen, en lettertype, kleur, spatiëring, randen, afbeeldingen en paginameubilair blijven niet behouden als een overeenkomende lay-out. Gebruik het resultaat om opnieuw typen te voorkomen, bouw vervolgens de vereiste structuur in de doeltoepassing opnieuw op en vergelijk belangrijke waarden met de bron voordat u erop vertrouwt.
Waarom kan de OCR-verwerkingstijd variëren?
De tijd is afhankelijk van de afbeeldingsafmetingen, het aantal en de grootte van tekstgebieden, de complexiteit van de lay-out, de geselecteerde taal, rotatie en de middelen die nodig zijn om de herkenning voor te bereiden. Een grote foto met een klein document in het midden kan meer werk vergen, terwijl de tekst nog steeds slechter is dan een strak bijgesneden scan. Gebruik de kleinste, heldere afbeelding waarin de benodigde tekens behouden blijven, snijd irrelevante gebieden bij en vermijd het herhaaldelijk vergroten van toch al scherpe bronnen. Houd de pagina open totdat er een resultaat of nuttige fout verschijnt.
Hoe moet ik geëxtraheerde OCR-tekst verifiëren?
Vergelijk namen, datums, adressen, totalen, decimale scheidingstekens, rekeningnummers, identificatiegegevens, interpunctie en elk teken waarbij een enkele fout de betekenis verandert. Veel voorkomende verwarringen zijn onder meer nul en O, één en kleine letter l, soortgelijke interpunctie, letters met accenten en visueel gerelateerde tekens in CJK- of Arabische schriften. Controleer de regelvolgorde en ontbrekende tekst rond afbeeldingen of tabellen. Gebruik voor juridisch, financieel, medisch, academisch of archiefmateriaal een tweede beoordeling van de originele afbeelding voordat u het resultaat naar een ander record kopieert.