Zo werkt afbeelding naar tekst
Sleep een foto van een document, een screenshot of een gescande pagina hierheen en de woorden erin worden herkend en opgeslagen als platte tekst die je kunt kopiëren, bewerken en doorzoeken. Dit is OCR, optische tekenherkenning, uitgevoerd door Tesseract, de opensource-engine die veel documentscanners gebruiken, en die draait in dit tabblad.
Kies vóór het converteren de taal van de tekst, uit 64 talen: Engels en de belangrijkste Europese talen, Russisch, Arabisch, Perzisch, Urdu en Hebreeuws, Hindi, Bengaals, Tamil en de andere grote Indiase schriften, Chinees, Japans en Koreaans (horizontaal of verticaal), Thai, Vietnamees en meer. Alleen het model voor de taal die je kiest wordt gedownload, van ongeveer 0.4 MB voor Perzisch tot 5.7 MB voor Sanskriet en ongeveer 3 MB voor Engels, en het wordt in de cache bewaard voor de volgende keer, net als de OCR-engine van ongeveer 4 MB.
Duidelijk gedrukte tekst op normale grootte wordt heel nauwkeurig gelezen. De resultaten worden minder bij handschrift, heel kleine of decoratieve lettertypen, weinig licht, onscherpte en schuin genomen foto's. De opmaak blijft niet behouden: de uitvoer bestaat uit de woorden in leesvolgorde, met regeleinden, niet uit een kopie van het paginaontwerp.
Omdat de herkenning op je apparaat gebeurt, is het geschikt voor bonnetjes, identiteitsbewijzen, brieven en andere afbeeldingen die je liever niet uploadt.
Het tekstbestand krijgt de naam van de afbeelding. Meerdere afbeeldingen kunnen in één keer worden gelezen, elk met een eigen tekstbestand, wat handig is bij een stapel bonnetjes of de pagina's van een gefotografeerd document. De nauwkeurigheid is het best bij donkere tekst op een lichte achtergrond, op de grootte van normale drukletters of groter. Screenshots van webpagina's en documenten worden bijna perfect gelezen, omdat de tekst daarin al scherp is.
Opties voor afbeelding naar tekst uitgelegd
| Talen | 64, waaronder Engels, Spaans, Frans, Duits, Russisch, Arabisch, Hindi, Bengaals, Chinees, Japans en Koreaans, met verticale modellen voor Chinees, Japans en Koreaans. |
|---|---|
| Uitvoer | Een tekstbestand, UTF-8. |
| Ook Engelse woorden lezen | Leest met de gekozen taal en Engels samen, voor gemengde tekst. |
| Engine | Tesseract, ongeveer 4 MB, plus het gekozen taalmodel (ongeveer 3 MB voor Engels), in de cache bewaard. |
| Opmaak | Niet behouden; woorden komen in leesvolgorde naar buiten. |
Wanneer je het gebruikt
Gebruik OCR om een citaat uit een screenshot te kopiëren, om de tekst van een gescande brief te krijgen zonder hem over te typen, om foto's van notities te doorzoeken, om een bord of menu te vertalen door de tekst in een vertaalprogramma te plakken, of om tekst uit een afbeelding in een document te hergebruiken.
Snijd de afbeelding voor het converteren bij tot alleen de tekst, en maak foto's recht van voren bij goed licht. Beide maken een groot verschil voor de nauwkeurigheid.
Over deze converter
Deze pagina is een snelkoppeling naar een van de meest gebruikte conversies, en accepteert elk bronformaat dat naar hetzelfde doelformaat kan. Ze gebruikt dezelfde engines als de rest van de site: ffmpeg, gecompileerd naar WebAssembly, voor video en audio, en Tesseract voor het lezen van tekst uit afbeeldingen, en beide draaien in je browser. De engines worden gedownload de eerste keer dat je op de knop drukt en voor latere bezoeken in de cache bewaard. Weet je precies om welke formaten het gaat, dan leggen de aparte pagina's, zoals MP4 naar GIF of JPG naar TXT, de details van dat paar uit, maar het resultaat van deze pagina is hetzelfde.
Problemen oplossen bij afbeelding naar tekst
“Er is geen tekst herkend”
De afbeelding is misschien onscherp, te klein of in een andere taal. Probeer een scherpere afbeelding, snijd bij tot de tekst en kies de juiste taal.
Letters zijn fout
Controleer de taalinstelling en probeer daarna een afbeelding met een hogere resolutie. Decoratieve lettertypen en handschrift zijn moeilijker te lezen.
Ik heb tekst uit een PDF-bestand nodig
Heeft het PDF-bestand selecteerbare tekst, gebruik dan PDF naar TXT. Is het een scan, converteer dan eerst een pagina naar JPG en gebruik die hier.
Zo zet je een afbeelding om naar tekst, stap voor stap
- Druk op “Afbeeldingen kiezen” of sleep bestanden naar het vak.
- Stel de opties in als dat nodig is; de standaardinstellingen passen bij de meeste toepassingen.
- Druk op “Tekst extraheren”. Het werk gebeurt op je apparaat.
- Sla het resultaat op met de downloadknop ernaast.
Is het veilig om dit online te doen?
Bij de meeste online tools betekent “online” dat je bestand wordt geüpload naar de server van een bedrijf, daar wordt verwerkt en een tijd wordt bewaard voordat het wordt verwijderd. Hier niet. De pagina downloadt de code van de tool naar je browser, en je bestand wordt in het tabblad op je eigen apparaat gelezen en verwerkt. Het wordt nooit naar TapToConvert of iemand anders gestuurd.
Je kunt dit zelf controleren: zodra de pagina en de engine geladen zijn, zet je de wifi uit en de tool werkt nog steeds. Dat betekent ook dat er geen wachtrij, geen daglimiet en geen maximale bestandsgrootte van een server is; de enige grens is het geheugen dat je browser één tabblad geeft.
Veelgestelde vragen over afbeelding naar tekst
Is afbeelding naar tekst gratis?
Ja, zonder limiet op het aantal afbeeldingen.
Kan het handschrift lezen?
Net handschrift werkt soms, maar Tesseract is gemaakt voor gedrukte tekst, dus reken op fouten.
Welke afbeeldingsformaten werken?
JPG, PNG, WebP, HEIC, GIF, BMP, TIFF en AVIF.
Worden mijn afbeeldingen geüpload?
Nee. De herkenning draait in je browser.
Is het gratis?
Ja. Geen aanmelding, geen watermerk en geen gebruikslimiet. TapToConvert wordt ondersteund door advertenties.
Worden mijn bestanden geüpload?
Nee. Alles gebeurt in je browsertabblad, op je eigen apparaat.