Gambar ke Teks — OCR Online Gratis
Ekstrak teks dari tangkapan layar, pemindaian dan foto dokumen, langsung di browser Anda. Gratis, tanpa pendaftaran, tidak ada yang diunggah.
Ingin berterima kasih kepada kami? Ceritakan kepada teman-teman Anda tentang LeanImg!
Cara Mengekstrak Teks dari Gambar
Pilih gambar Anda
Pilih file atau seret dan jatuhkan ke dalam ekstraktor. JPG, PNG, WebP, GIF, BMP, AVIF dan HEIC semua berfungsi.
Pilih bahasa dan ekstrak
Pilih bahasa teks, lalu klik Ekstrak. Saat pertama kali dijalankan untuk suatu bahasa, alat ini akan mengunduh model bahasa tersebut ke browser Anda.
Salin atau unduh teks
Baca hasilnya, salin ke clipboard Anda atau simpan sebagai file .txt.
Mengapa LeanImg?
Sebagian besar situs OCR online meminta Anda untuk mengunggah gambar terlebih dahulu. Itu adalah hal aneh untuk diterima untuk kartu ID, slip gaji atau kontrak yang ditandatangani, dan itu tidak lagi diperlukan, karena browser modern dapat melakukan pengenalan sendiri. LeanImg mengekstrak teks dari gambar sepenuhnya di perangkat Anda, jadi tidak ada yang ditransmisikan ke mana pun. Tidak ada pendaftaran, tidak ada watermark dan tidak ada kredit per gambar yang harus dibeli, dan ia membaca teks Latin, Cyrillic, Yunani, Arab dan Jepang. Tangkapan layar dan pemindaian bersih adalah apa yang dilakukannya dengan baik, dan kami mengatakannya dengan jelas daripada menjanjikan akurasi sempurna di setiap foto. Jelajahi semua alat gambar gratis kami untuk menjaga sisa pekerjaan Anda di browser juga.
Berjalan di Perangkat Anda
Gambar dibaca, dikenali dan diubah menjadi teks di dalam halaman ini. Tidak ada yang diunggah, jadi dokumen pribadi tetap pribadi.
Gratis dan Tidak Terbatas
Tidak ada pendaftaran, tidak ada kredit, tidak ada watermark dan tidak ada tingkat berbayar. Jalankan sebanyak mungkin batch yang Anda suka tanpa biaya.
Membaca Beberapa Skrip
Teks Latin, Cyrillic, Yunani, Arab dan Jepang semuanya didukung. Pilih bahasa dan mesin memuat model yang sesuai.
Bagaimana tampilan angka
Klaim akurasi itu murah, jadi berikut adalah pengukurannya. Enam fixture melalui mesin ini, masing-masing dengan teks yang diketahui sebelumnya. Skor adalah perbandingan karakter demi karakter dari output terhadap teks yang diketahui tersebut. Fixture adalah sintetis. Mereka adalah halaman HTML yang dirender di browser dan ditangkap sebagai tangkapan layar yang nyata, dan baris yang terdegradasi adalah teks yang sama di bawah blur dan rotasi CSS, sehingga meniru tangkapan buruk dari ponsel.
| Gambar uji | Bahasa | Kesamaan | Kepercayaan |
|---|---|---|---|
| Tangkapan layar bersih | Inggris | 100.0% | 95 |
| Paragraf padat | Inggris | 100.0% | 95 |
| Tangkapan terdegradasi yang disimulasikan | Inggris | 92.4% | 65 |
| Contoh Rusia | Rusia | 100.0% | 96 |
| Contoh Jepang | Jepang | 100.0% | 93 |
| Foto tanpa teks di dalamnya | Inggris | 515 karakter teks yang dibuat-buat | 32 |
Baris terakhir adalah yang perlu dibaca dua kali. Fixture itu adalah foto gelap kupu-kupu di atas batang lumut, dan tidak ada tulisan di mana pun di dalamnya. Mesin mengembalikan 515 karakter teks yang tidak pernah ada. Mesin OCR melakukan ini. Mereka dibangun untuk menemukan bentuk karakter, sehingga butiran dan tekstur dilaporkan sebagai karakter, dan tidak ada tahap dalam jalur yang memutuskan sebuah gambar kosong. Kami tidak mengklaim dapat mendeteksi gambar kosong, karena kami tidak bisa. Setiap hasil membawa skor kepercayaan dan peringatan muncul ketika rata-rata turun di bawah 60. Foto itu mendapat skor 32, dibandingkan 95 untuk tangkapan layar bersih. Angka tersebut adalah hal yang perlu dibaca sebelum Anda mempercayai teks.
Apa yang diunduh pada penggunaan pertama
Pengakuan berjalan di mesin Anda, jadi mesin harus sampai di sana terlebih dahulu. Mulai dingin dalam bahasa Inggris adalah 3 permintaan dan sekitar 6 MB, yang merupakan pekerja, inti WebAssembly, dan model bahasa Inggris. Ketiga hal ini disajikan dari situs ini dan tidak ada dari mereka yang merupakan CDN pihak ketiga. Browser Anda menyimpannya, jadi jalankan kedua dalam bahasa itu dimulai tanpa apa pun untuk diambil. Setiap bahasa lebih lanjut menambahkan modelnya sendiri, antara sekitar 0.6 dan 2 MB tergantung pada skrip, dan semua sembilan bersama-sama sekitar 11 MB. Tidak ada yang bergerak ke arah lain: gambar Anda dibaca ke dalam halaman dan diserahkan kepada mesin dalam memori, dan tidak ada permintaan yang membawanya keluar.
Di mana ia berfungsi dan di mana ia gagal
Tangkapan layar dan pemindaian bersih adalah kasus yang baik, dan tabel menunjukkan seberapa baik: tiga fixture kembali dengan 100.0%, karakter demi karakter. Baris yang terdegradasi adalah yang berguna. Sebuah blur dan rotasi kecil di atas teks yang sama menghabiskan 7.6 poin kesamaan dan menurunkan kepercayaan dari 95 menjadi 65, yang cukup rendah untuk memicu peringatan di kartu hasil. Itu kira-kira apa yang dilakukan foto ponsel yang terburu-buru dari sebuah halaman. Tulisan tangan dan teks yang difoto dalam sebuah adegan, seperti tanda toko atau label rak, berada di luar apa yang dibangun untuk mesin ini, dan kami tidak membuat klaim tentang keduanya. Berikan salinan terbesar dan terjelas yang Anda miliki. Mengurangi ukuran tangkapan layar terlebih dahulu membuang piksel yang dibuat dari karakter, jadi jika file harus lebih kecil, kirimkan ke kompresor atau pengubah ukuran setelah teks dikeluarkan.
Pertanyaan yang Sering Diajukan
Bagaimana cara kerja ekstraksi gambar ke teks?
OCR adalah singkatan dari pengenalan karakter optik. Mesin menemukan bentuk dalam gambar Anda, mencocokkannya dengan model terlatih untuk bahasa yang Anda pilih dan menuliskan karakter yang dikenali. Semua itu terjadi di dalam halaman ini. LeanImg menggunakan Tesseract, mesin OCR sumber terbuka, yang dikompilasi ke WebAssembly sehingga berjalan di perangkat keras Anda sendiri alih-alih server.
Apakah gambar saya diunggah ke server?
Tidak. Satu-satunya permintaan yang dibuat oleh ekstraktor adalah untuk mesin OCR dan model bahasa, keduanya disajikan dari situs ini, dan mereka bergerak dalam satu arah. Gambar Anda dibaca dari disk ke halaman, diserahkan ke mesin dalam memori dan diubah menjadi teks di sana. Tidak ada endpoint unggah dalam kode untuk menerimanya. Itu penting ketika gambar adalah kartu ID, slip gaji atau kontrak yang ditandatangani. Buka tab jaringan Anda selama menjalankan: Anda akan melihat file model tiba dan tidak ada yang membawa gambar Anda pergi.
Format gambar apa yang dapat saya ekstrak teksnya?
JPG, PNG, WebP, GIF dan BMP langsung ke mesin. AVIF dan HEIC didekodekan di halaman sebelum mesin melihatnya, jadi foto langsung dari iPhone tidak perlu dikonversi terlebih dahulu. Apa pun yang masuk, teks biasa keluar.
Bahasa apa saja yang didukung oleh OCR?
Inggris, Spanyol, Rumania, Arab, Yunani, Turki, Indonesia, Rusia dan Jepang. Pilih bahasa sebelum Anda mengekstrak, karena mesin mencocokkan bentuk dengan model yang Anda pilih dan model yang salah terbaca dengan buruk. Pemilih dimulai pada bahasa halaman yang Anda buka. Belum ada deteksi bahasa otomatis di sini.
Mengapa penggunaan pertama mengunduh model?
Karena pengenalan terjadi di perangkat Anda, jadi model harus sampai di sana terlebih dahulu. Pertama kali Anda menggunakan bahasa, file datanya diunduh dan browser menyimpannya, dan jalankan berikutnya dalam bahasa itu dimulai segera. Itu adalah pertukaran untuk privasi. Layanan OCR yang dihosting mengunggah gambar Anda dan menyimpan model di mesin mereka sendiri. Yang ini menyimpan gambar Anda dan mengambil model sebagai gantinya. Beralih ke bahasa yang belum Anda gunakan juga mengunduh model itu.
Apakah konverter gambar ke teks benar-benar gratis?
Ya, gratis tanpa akun dan tanpa penghitung penggunaan. Tidak ada pendaftaran, tidak ada watermark pada teks, tidak ada kredit dan tidak ada tingkat berbayar yang menahan versi yang baik. Pekerjaan berjalan di perangkat keras Anda, jadi tidak ada biaya server per gambar yang harus kami teruskan kepada Anda.
Seberapa akurat ekstraksi teks?
Itu tergantung pada input, dan perbedaannya besar. Tangkapan layar dan pemindaian bersih terbaca dengan sangat baik, karena karakter tajam, pencahayaan merata dan posisinya lurus. Foto kertas kurang dapat diprediksi, dan semakin buruk dengan kabur, silau, bayangan atau sudut miring. Ada kasus yang tidak akan kami coba tangani: tulisan tangan dan teks dalam suatu adegan seperti papan nama toko atau label di rak. Mesin ini dibangun untuk karakter cetak. Situs lain mengiklankan akurasi sempurna di semua itu. Klaim itu tidak benar untuk mesin OCR mana pun, termasuk yang ini, jadi baca output sebelum Anda mengandalkannya.
Berapa banyak gambar yang dapat saya proses sekaligus?
Anda dapat memilih satu batch, dan dropzone menunjukkan batas untuk satu kali jalankan. Gambar diproses secara berurutan daripada secara paralel, dan setiap hasil muncul segera setelah selesai, sehingga Anda dapat mulai membaca dan menyalin sementara yang lainnya masih bekerja. Pemrosesan berurutan juga menjaga penggunaan memori dapat diprediksi di ponsel.
Apa arti peringatan kepercayaan rendah?
Mesin melaporkan seberapa yakin ia tentang setiap kata yang dibaca, dan kartu hasil menunjukkan rata-rata untuk gambar. Ketika rata-rata itu jatuh di bawah ambang batas yang kami tetapkan, Anda mendapatkan peringatan alih-alih hasil yang terlihat bersih. Itu bukan keputusan bahwa teks itu salah. Itu adalah sinyal untuk memeriksanya. Dalam praktiknya, itu muncul pada tangkapan yang kabur, kontras rendah, teks yang sangat kecil dan pemilihan bahasa yang salah.
Bagaimana cara mendapatkan hasil OCR yang lebih baik?
Beri mesin karakter yang lebih besar dan tajam. Ambil tangkapan layar dari sumbernya daripada memotret kapan pun itu mungkin. Jika Anda harus menggunakan kamera, ambil gambar secara langsung daripada pada sudut, isi bingkai dengan teks dan jaga pencahayaannya merata sehingga tidak ada silau atau bayangan yang melintasi halaman. Teks gelap di latar belakang terang terbaca dengan baik. Pilih bahasa yang tepat sebelum Anda mengekstrak, karena pilihan itu mengubah hasil lebih dari hal lain dalam daftar ini.
Dapatkah saya mengekstrak teks dari tangkapan layar?
Ya, dan tangkapan layar adalah kasus terbaik untuk alat ini. Ini adalah teks yang dirender: tepi tajam, latar belakang datar, tidak ada lensa dan tidak ada pencahayaan yang harus dilawan. Itu persis apa yang dibaca oleh mesin OCR teks cetak. Tangkapan layar pesan kesalahan, utas obrolan, dialog aplikasi dan output terminal semuanya berjalan dengan baik. Tata letak tabel tidak direkonstruksi, jadi Anda mendapatkan kata-kata, bukan grid.
Apa yang bisa saya lakukan dengan teks yang diekstrak?
Salin ke clipboard Anda, atau unduh sebagai file .txt. Ketika Anda memproses batch, Anda juga dapat mengunduh semuanya sebagai satu .txt. Tidak ada output PDF yang dapat dicari di sini, dan kami lebih suka mengatakan itu secara jelas daripada menyiratkannya: alat ini memberi Anda teks biasa, bukan dokumen yang dibangun kembali dengan tata letak asli. Jika Anda memerlukan kata-kata dalam spreadsheet, dokumen atau penerjemah, tempelkan di sana.
Punya lebih banyak pertanyaan? Pelajari lebih lanjut tentang LeanImg dan bagaimana kami memproses gambar Anda.
Butuh file yang lebih kecil? Kompres gambar Anda untuk mengurangi ukuran file. Butuh format yang berbeda? Konversi antara format seperti JPG, PNG, WebP dan AVIF. Butuh dimensi yang berbeda? Ubah ukuran gambar Anda ke ukuran yang tepat.