Afbeelding naar tekst — Gratis Online OCR
Extraheer tekst uit screenshots, scans en foto's van documenten, direct in je browser. Gratis, geen registratie, niets geüpload.
Wil je ons bedanken? Vertel je vrienden over LeanImg!
Hoe tekst uit een afbeelding te extraheren
Selecteer je afbeeldingen
Kies bestanden of sleep ze naar de extractor. JPG, PNG, WebP, GIF, BMP, AVIF en HEIC werken allemaal.
Kies een taal en extraheer
Kies de taal van de tekst en klik vervolgens op Extraheer. De eerste uitvoering in een taal downloadt zijn model naar je browser.
Kopieer of download de tekst
Lees het resultaat, kopieer het naar je klembord of sla het op als een .txt-bestand.
Waarom LeanImg?
De meeste online OCR-sites vragen je om eerst de afbeelding te uploaden. Dat is een vreemde zaak om te accepteren voor een ID-kaart, een loonstrook of een ondertekend contract, en het is niet langer nodig, omdat een moderne browser de herkenning zelf kan doen. LeanImg extraheert tekst uit afbeeldingen volledig op je apparaat, zodat er niets ergens wordt verzonden. Er is geen registratie, geen watermerk en geen kosten per afbeelding om te kopen, en het leest Latijnse, Cyrillische, Griekse, Arabische en Japanse tekst. Screenshots en schone scans zijn waar het het beste in is, en we zeggen dat eenvoudig in plaats van perfecte nauwkeurigheid op elke foto te beloven. Ontdek al onze gratis afbeeldingshulpmiddelen om de rest van je werk ook in de browser te houden.
Draait op jouw apparaat
De afbeelding wordt gelezen, herkend en omgezet in tekst binnen deze pagina. Er wordt niets geüpload, zodat privé documenten privé blijven.
Gratis en onbeperkt
Geen registratie, geen credits, geen watermerken en geen betaald niveau. Voer zoveel batches uit als je wilt zonder kosten.
Leest verschillende scripts
Latijnse, Cyrillische, Griekse, Arabische en Japanse tekst worden allemaal ondersteund. Kies de taal en de engine laadt het bijpassende model.
Hoe de nummers eruitzien
Nauwkeurigheidsclaims zijn goedkoop, dus hier is de meting. Zes fixtures zijn door deze engine gegaan, elk met zijn tekst van tevoren bekend. De score is een vergelijking van karakter voor karakter van de output met die bekende tekst. De fixtures zijn synthetisch. Het zijn HTML-pagina's die in een browser zijn weergegeven en als echte screenshots zijn vastgelegd, en de gedegradeerde rij is diezelfde tekst onder een CSS-blur en rotatie, zodat het een slechte telefoonopname imiteert.
| Fixture | Taal | Gelijkenis | Vertrouwen |
|---|---|---|---|
| Schone screenshot | Engels | 100.0% | 95 |
| Dichte alinea | Engels | 100.0% | 95 |
| Gesimuleerde gedegradeerde opname | Engels | 92.4% | 65 |
| Russisch voorbeeld | Russisch | 100.0% | 96 |
| Japans voorbeeld | Japans | 100.0% | 93 |
| Foto zonder tekst erin | Engels | 515 karakters van uitgevonden tekst | 32 |
De laatste rij is de enige die je twee keer moet lezen. Die fixture is een donkere foto van vlinders boven een mosachtige boomstam, en er is nergens tekst in te vinden. De engine gaf 515 karakters tekst terug die er nooit was. OCR-engines doen dit. Ze zijn gebouwd om karaktervormen te vinden, zodat korrel en textuur als karakters worden gerapporteerd, en er is geen fase in de pijplijn die beslist dat een afbeelding leeg is. We beweren niet een lege afbeelding te detecteren, omdat we dat niet kunnen. Elk resultaat draagt zijn vertrouwensscore en er gaat een waarschuwing af wanneer het gemiddelde onder de 60 zakt. Die foto scoorde 32, tegen 95 voor een schone screenshot. Het nummer is hetgene dat je moet lezen voordat je het vertrouwen in de tekst hebt.
Wat er wordt gedownload bij eerste gebruik
Herkenning draait op jouw machine, dus de machine moet daar eerst komen. Een koude start in het Engels is 3 verzoeken en ongeveer 6 MB, wat de worker, de WebAssembly-kern en het Engelse model is. Alle drie worden van deze site geleverd en geen van hen is een derde partij CDN. Jouw browser cachet ze, dus de tweede run in die taal begint zonder iets te hoeven ophalen. Elke verdere taal voegt zijn eigen model toe, tussen ongeveer 0,6 en 2 MB afhankelijk van het script, en alle negen samen zijn ongeveer 11 MB. Niets reist de andere kant op: jouw afbeelding wordt in de pagina gelezen en aan de engine in het geheugen gegeven, en geen verzoek draagt het eruit.
Waar het werkt en waar het faalt
Screenshots en schone scans zijn de goede gevallen, en de tabel toont hoe goed: drie fixtures kwamen terug op 100.0%, karakter voor karakter. De gedegradeerde rij is de nuttige. Een blur en een kleine rotatie over dezelfde tekst kostten 7.6 punten gelijkenis en duwden het vertrouwen van 95 naar 65, wat laag genoeg is om de waarschuwing op de resultaatkaart te laten afgaan. Dat is ongeveer wat een gehaaste telefoonfoto van een pagina doet. Handgeschreven tekst en tekst gefotografeerd in een scène, zoals een winkelbord of een schaplabel, vallen buiten waar deze engine voor is gebouwd, en we doen geen claim over beide. Geef het de grootste, scherpste kopie die je hebt. Het verkleinen van een screenshot gooit eerst de pixels weg waaruit de karakters zijn opgebouwd, dus als het bestand kleiner moet worden, stuur het dan naar de compressor of de resizer zodra de tekst eruit is.
Veelgestelde Vragen
Hoe werkt de extractie van afbeelding naar tekst?
OCR staat voor optische tekenherkenning. De engine vindt de vormen in je afbeelding, vergelijkt ze met een getraind model voor de taal die je hebt gekozen en schrijft de karakters die het herkent. Dat alles gebeurt binnen deze pagina. LeanImg gebruikt Tesseract, de open source OCR-engine, gecompileerd naar WebAssembly zodat het op je eigen hardware draait in plaats van op een server.
Wordt mijn afbeelding naar een server geüpload?
Nee. De enige verzoeken die de extractor doet zijn voor de OCR-engine en het taalmodel, beide aangeboden vanaf deze site, en ze reizen in één richting. Je afbeelding wordt van de schijf in de pagina gelezen, aan de engine in het geheugen gegeven en daar omgezet in tekst. Er is geen upload-eindpunt in de codebase om het te ontvangen. Dat is belangrijk wanneer de afbeelding een ID-kaart, een loonstrook of een ondertekend contract is. Open je netwerk-tab tijdens een uitvoering: je zult modelbestanden zien aankomen en niets dat je afbeelding wegbrengt.
Van welke afbeeldingsformaten kan ik tekst extraheren?
JPG, PNG, WebP, GIF en BMP gaan rechtstreeks naar de engine. AVIF en HEIC worden in de pagina gedecodeerd voordat de engine ze ziet, zodat een foto rechtstreeks van een iPhone niet eerst hoeft te worden geconverteerd. Wat erin gaat, komt eruit als platte tekst.
Welke talen ondersteunt de OCR?
Engels, Spaans, Roemeens, Arabisch, Grieks, Turks, Indonesisch, Russisch en Japans. Kies de taal voordat je extraheert, omdat de engine vormen vergelijkt met het model dat je kiest en het verkeerde model slecht leest. De picker begint op de taal van de pagina waarop je je bevindt. Er is hier nog geen automatische taalherkenning.
Waarom downloadt de eerste uitvoering een model?
Omdat de herkenning op je apparaat gebeurt, moet het model daar eerst komen. De eerste keer dat je een taal gebruikt, wordt het gegevensbestand gedownload en de browser cachet het, en latere uitvoeringen in die taal starten onmiddellijk. Dat is de ruil voor privacy. Een gehoste OCR-service uploadt je afbeelding en houdt het model op zijn eigen machine. Deze houdt je afbeelding en haalt in plaats daarvan het model op. Overschakelen naar een taal die je nog niet hebt gebruikt, downloadt dat model ook.
Is de afbeelding naar tekst converter echt gratis?
Ja, gratis zonder account en zonder gebruiksregistratie. Er is geen registratie, geen watermerk op de tekst, geen credits en geen betaald niveau dat de goede versie tegenhoudt. Het werk draait op je hardware, dus er zijn geen kosten per afbeelding die we aan jou doorgeven.
Hoe nauwkeurig is de tekstextractie?
Het hangt af van de invoer, en het verschil is groot. Screenshots en schone scans lezen heel goed, omdat de karakters scherp, gelijkmatig verlicht en rechtop staan. Foto's van papier zijn minder voorspelbaar, en ze worden slechter met vervaging, schittering, schaduw of een hellende hoek. Er zijn gevallen die we niet zullen doen alsof we kunnen behandelen: handschrift en tekst in een scène zoals een winkelbord of een label op een plank. Deze engine is gebouwd voor afgedrukte karakters. Andere sites adverteren perfecte nauwkeurigheid op al deze. Die claim is niet waar voor enige OCR-engine, inclusief deze, dus lees de output voordat je erop vertrouwt.
Hoeveel afbeeldingen kan ik tegelijk verwerken?
Je kunt een batch selecteren, en de dropzone toont de limiet voor een enkele uitvoering. Afbeeldingen worden sequentieel verwerkt in plaats van parallel, en elk resultaat verschijnt zodra het is voltooid, zodat je kunt beginnen met lezen en kopiëren terwijl de rest nog bezig is. Sequentiële verwerking houdt ook het geheugengebruik voorspelbaar op telefoons.
Wat betekent de waarschuwing voor laag vertrouwen?
De engine rapporteert hoe zeker het is over elk woord dat het leest, en de resultaatkaart toont het gemiddelde voor de afbeelding. Wanneer dat gemiddelde onder de drempel valt die we hebben ingesteld, krijg je een waarschuwing in plaats van een schoon uitziend resultaat. Het is geen oordeel dat de tekst fout is. Het is een signaal om het te controleren. In de praktijk gebeurt dit bij vage opnames, laag contrast, zeer kleine tekst en de verkeerde taalkeuze.
Hoe krijg ik betere OCR-resultaten?
Geef de engine grotere, scherpere karakters. Screenshot de bron in plaats van deze te fotograferen wanneer dat mogelijk is. Als je een camera moet gebruiken, schiet dan recht van voren in plaats van onder een hoek, vul het kader met de tekst en houd de verlichting gelijkmatig zodat er geen schittering of schaduw over de pagina valt. Donkere tekst op een lichte achtergrond leest het beste. Kies de juiste taal voordat je extraheert, aangezien die keuze het resultaat meer verandert dan iets anders op deze lijst.
Kan ik tekst extraheren uit een screenshot?
Ja, en een screenshot is het beste geval voor deze tool. Het is gerenderde tekst: scherpe randen, vlakke achtergrond, geen lens en geen verlichting om tegen te vechten. Dat is precies wat een OCR-engine voor afgedrukte tekst is gebouwd om te lezen. Screenshots van foutmeldingen, chatthreads, appdialoogvensters en terminaluitvoer komen allemaal goed door. Tabelindelingen worden niet gereconstrueerd, dus je krijgt de woorden, niet het raster.
Wat kan ik doen met de geëxtraheerde tekst?
Kopieer het naar je klembord, of download het als een .txt-bestand. Wanneer je een batch verwerkt, kun je ook alles als een enkele .txt downloaden. Er is hier geen doorzoekbare PDF-output, en we zouden liever dat eenvoudig zeggen dan het impliceren: deze tool geeft je platte tekst, geen opnieuw opgebouwde document met de originele lay-out. Als je de woorden in een spreadsheet, document of vertaler nodig hebt, plak ze daar.
Heb je meer vragen? Leer meer over LeanImg en hoe we je afbeeldingen verwerken.
Heb je kleinere bestanden nodig? Comprimeer je afbeeldingen om de bestandsgrootte te verkleinen. Heb je een ander formaat nodig? Converteer tussen formaten zoals JPG, PNG, WebP en AVIF. Heb je andere afmetingen nodig? Wijzig de grootte van je afbeeldingen naar een exacte maat.