Imagine în text — OCR online gratuit
Extrage text din capturi de ecran, scanări și fotografii ale documentelor, direct în browserul tău. Gratuit, fără înscriere, nimic încărcat.
Vreți să ne mulțumiți? Spuneți-le prietenilor despre LeanImg!
Cum să extragi text dintr-o imagine
Selectează-ți imaginile
Alege fișiere sau trage-le și lasă-le în extractor. JPG, PNG, WebP, GIF, BMP, AVIF și HEIC funcționează toate.
Alege o limbă și extrage
Alege limba textului, apoi apasă Extrage. Prima rulare într-o limbă descarcă modelul său în browserul tău.
Copiază sau descarcă textul
Citește rezultatul, copiază-l în clipboard-ul tău sau salvează-l ca fișier .txt.
De ce LeanImg?
Cele mai multe site-uri OCR online îți cer să încarci mai întâi imaginea. Este un lucru ciudat de acceptat pentru un card de identitate, un fluturaș de plată sau un contract semnat, și nu mai este necesar, deoarece un browser modern poate face recunoașterea singur. LeanImg extrage text din imagini complet pe dispozitivul tău, astfel că nimic nu este transmis nicăieri. Nu există înscriere, nu există filigran și nu există credit pe imagine de cumpărat, și citește text în limba latină, chirilică, greacă, arabă și japoneză. Capturile de ecran și scanările curate sunt ceea ce face cel mai bine, și spunem asta clar în loc să promitem o precizie perfectă pentru fiecare fotografie. Explorează toate instrumentele noastre gratuite pentru imagini pentru a păstra restul muncii tale în browser și.
Rulează pe dispozitivul tău
Imaginea este citită, recunoscută și transformată în text chiar în această pagină. Nimic nu se încarcă pe server, deci documentele private rămân private.
Gratuit și nelimitat
Fără cont, fără credite, fără filigrane și fără abonament plătit. Rulează oricâte loturi vrei, fără niciun cost.
Citește mai multe alfabete
Textele în alfabet latin, chirilic, grec, arab și japonez sunt toate acceptate. Alege limba și motorul încarcă modelul potrivit.
Cum arată numerele
Afirmațiile de acuratețe sunt ieftine, așa că iată măsurătoarea. Șase fixture au trecut prin acest motor, fiecare cu textul său cunoscut dinainte. Scorul este o comparație caracter cu caracter a ieșirii față de acel text cunoscut. Fixturele sunt sintetice. Ele sunt pagini HTML randate într-un browser și capturate ca capturi de ecran reale, iar rândul degradat este același text sub un blur CSS și rotație, astfel încât imită o captură proastă de telefon.
| Imagine de test | Limba | Similaritate | Încredere |
|---|---|---|---|
| Captură de ecran curată | Engleză | 100.0% | 95 |
| Paragraf dens | Engleză | 100.0% | 95 |
| Captură degradată simulată | Engleză | 92.4% | 65 |
| Exemplu rus | Rusă | 100.0% | 96 |
| Exemplu japonez | Japoneză | 100.0% | 93 |
| Fotografie fără text | Engleză | 515 caractere de text inventat | 32 |
Ultimul rând este cel pe care trebuie să-l citești de două ori. Acest fixture este o fotografie întunecată a fluturilor deasupra unui buștean acoperit de mușchi, și nu există nicio scriere în el. Motorul a returnat 515 caractere de text care nu au fost niciodată acolo. Motoarele OCR fac asta. Ele sunt construite pentru a găsi formele caracterelor, astfel încât granulația și textura sunt raportate ca caractere, și nu există nicio etapă în proces care să decidă că o imagine este goală. Nu pretindem că putem detecta o imagine goală, deoarece nu putem. Fiecare rezultat poartă scorul său de încredere și se activează un avertisment când media scade sub 60. Acea fotografie a avut un scor de 32, față de 95 pentru o captură de ecran curată. Numărul este lucrul pe care trebuie să-l citești înainte de a avea încredere în text.
Ce se descarcă la prima utilizare
Recunoașterea rulează pe mașina ta, așa că mecanismul trebuie să ajungă acolo mai întâi. Un start rece în engleză este 3 cereri și aproximativ 6 MB, care este lucrătorul, nucleul WebAssembly și modelul în engleză. Toate trei sunt servite de acest site și niciunul dintre ele nu este un CDN de terță parte. Browserul tău le stochează în cache, așa că a doua rulare în acea limbă începe fără nimic de descărcat. Fiecare limbă suplimentară adaugă propriul său model, între aproximativ 0.6 și 2 MB în funcție de script, iar toate nouă împreună sunt aproximativ 11 MB. Nimic nu călătorește în cealaltă direcție: imaginea ta este citită în pagină și predată motorului în memorie, iar nicio cerere nu o transportă afară.
Unde funcționează și unde eșuează
Capturile de ecran și scanările curate sunt cazul bun, iar tabelul arată cât de bun: trei fixture au revenit la 100.0%, caracter cu caracter. Rândul degradat este cel util. Un blur și o mică rotație peste același text costă 7.6 puncte de similaritate și a redus încrederea de la 95 la 65, ceea ce este suficient de scăzut pentru a activa avertismentul pe cardul de rezultat. Asta este aproximativ ceea ce face o fotografie grăbită de telefon a unei pagini. Scrisul de mână și textul fotografiat într-o scenă, cum ar fi un semn de magazin sau o etichetă de raft, se află în afara a ceea ce este construit acest motor, și nu facem nicio afirmație despre niciunul dintre ele. Dă-i cea mai mare și mai clară copie pe care o ai. Micșorarea unei capturi de ecran mai întâi aruncă pixelii din care sunt făcute caracterele, așa că dacă fișierul trebuie să devină mai mic, trimite-l la compresor sau la redimensionator odată ce textul este scos.
Întrebări frecvente
Cum funcționează extragerea textului din imagine?
OCR înseamnă recunoașterea optică a caracterelor. Motorul găsește formele din imaginea ta, le compară cu un model antrenat pentru limba aleasă și scrie caracterele pe care le recunoaște. Totul se întâmplă în această pagină. LeanImg folosește Tesseract, motorul OCR open source, compilat în WebAssembly, astfel încât să ruleze pe hardware-ul tău în loc de un server.
Imaginea mea este încărcată pe un server?
Nu. Singurele cereri pe care le face extractorul sunt pentru motorul OCR și modelul de limbă, ambele servite din acest site, și călătoresc într-o singură direcție. Imaginea ta este citită din disc în pagină, predată motorului în memorie și transformată în text acolo. Nu există un punct final de încărcare în cod pentru a o primi. Acest lucru contează atunci când imaginea este un card de identitate, un fluturaș de plată sau un contract semnat. Deschide tab-ul de rețea în timpul unei rulări: vei vedea fișierele model sosind și nimic care să transporte imaginea ta.
Din ce formate de imagine pot extrage text?
JPG, PNG, WebP, GIF și BMP merg direct la motor. AVIF și HEIC sunt decodificate în pagină înainte ca motorul să le vadă, astfel încât o fotografie direct de pe un iPhone nu are nevoie de conversie mai întâi. Orice intră, iese text simplu.
Ce limbi suportă OCR-ul?
Engleză, Spaniolă, Română, Arabă, Greacă, Turcă, Indoneziană, Rusă și Japoneză. Alege limba înainte de a extrage, deoarece motorul compară formele cu modelul pe care îl alegi și modelul greșit citește prost. Selectorul începe pe limba paginii pe care te afli. Nu există încă o detectare automată a limbii aici.
De ce prima rulare descarcă un model?
Pentru că recunoașterea se face pe dispozitivul tău, astfel încât modelul trebuie să ajungă acolo mai întâi. Prima dată când folosești o limbă, fișierul său de date se descarcă și browserul îl cache-uiește, iar rulările ulterioare în acea limbă încep imediat. Acesta este compromisul acceptat pentru confidențialitate. Un serviciu OCR găzduit îți încarcă imaginea și păstrează modelul pe propria mașină. Acesta păstrează imaginea ta și obține modelul în schimb.
Converterul de imagine în text este cu adevărat gratuit?
Da, gratuit fără cont și fără contor de utilizare. Nu există înscriere, nu există filigran pe text, nu există credite și nu există un nivel plătit care să rețină versiunea bună. Lucrul se desfășoară pe hardware-ul tău, astfel încât nu există cost pe imagine pentru noi să ți-l transmitem.
Cât de precisă este extragerea textului?
Depinde de intrare, iar diferența este mare. Capturile de ecran și scanările curate se citesc foarte bine, deoarece caracterele sunt clare, uniform iluminate și așezate drept. Fotografii ale hârtiei sunt mai puțin previzibile și devin mai proaste cu neclaritate, reflexie, umbră sau un unghi înclinat. Există cazuri pe care nu ne vom pretinde că le gestionăm: scrisul de mână și textul dintr-o scenă, cum ar fi un semn de magazin sau o etichetă pe un raft. Acest motor este construit pentru caractere tipărite. Alte site-uri promovează o precizie perfectă în toate acestea. Această afirmație nu este adevărată pentru niciun motor OCR, inclusiv acesta, așa că citește ieșirea înainte de a te baza pe ea.
Câte imagini pot procesa simultan?
Poți selecta un lot, iar zona de tragere arată limita pentru o singură rulare. Imaginile sunt procesate secvențial, mai degrabă decât în paralel, iar fiecare rezultat apare imediat ce este terminat, astfel încât poți începe să citești și să copiezi în timp ce restul sunt încă în lucru. Procesarea secvențială menține, de asemenea, utilizarea memoriei previzibilă pe telefoane.
Ce înseamnă avertismentul de încredere scăzută?
Motorul raportează cât de sigur este cu privire la fiecare cuvânt pe care îl citește, iar cardul de rezultat arată media pentru imagine. Când acea medie scade sub pragul pe care l-am stabilit, primești un avertisment în loc de un rezultat care arată bine. Nu este un verdict că textul este greșit. Este un semnal să-l verifici. În practică, se activează pe capturi neclare, contrast scăzut, text foarte mic și selecția greșită a limbii.
Cum pot obține rezultate OCR mai bune?
Oferă motorului caractere mai mari și mai clare. Captura sursei mai degrabă decât fotografierea acesteia ori de câte ori este posibil. Dacă trebuie să folosești o cameră, fotografiază direct în loc de un unghi, umple cadrul cu textul și menține iluminarea uniformă astfel încât să nu existe reflexie sau umbră care să traverseze pagina. Textul întunecat pe un fundal deschis se citește cel mai bine. Alege limba corectă înainte de a extrage, deoarece acea alegere schimbă rezultatul mai mult decât orice altceva de pe această listă.
Pot extrage text dintr-o captură de ecran?
Da, iar o captură de ecran este cel mai bun caz pentru acest instrument. Este text redat: margini clare, fundal plat, fără lentilă și fără iluminare de combătut. Aceasta este exact ceea ce un motor OCR pentru text tipărit este construit să citească. Capturile de ecran ale mesajelor de eroare, firului de chat, dialogurilor aplicației și ieșirii terminalului trec toate bine. Layout-ul tabelului nu este reconstruit, astfel încât obții cuvintele, nu grila.
Ce pot face cu textul extras?
Copiază-l în clipboard-ul tău sau descarcă-l ca fișier .txt. Când procesezi un lot, poți de asemenea să descarci totul ca un singur .txt. Nu există ieșire PDF căutabilă aici, și am prefera să spunem asta clar decât să implicăm: acest instrument îți oferă text simplu, nu un document reconstruit cu layout-ul original. Dacă ai nevoie de cuvinte într-un spreadsheet, un document sau un translator, lipește-le acolo.
Ai mai multe întrebări? Află mai multe despre LeanImg și cum procesăm imaginile tale.
Ai nevoie de fișiere mai mici? Comprimă-ți imaginile pentru a reduce dimensiunea fișierului. Ai nevoie de un format diferit? Convertește între formate precum JPG, PNG, WebP și AVIF. Ai nevoie de dimensiuni diferite? Redimensionează-ți imaginile la o dimensiune exactă.