Изображение в текст — Бесплатный онлайн OCR
Извлеките текст из скриншотов, сканов и фотографий документов прямо в вашем браузере. Бесплатно, без регистрации, ничего не загружается.
Хотите нас поблагодарить? Расскажите своим друзьям о LeanImg!
Как извлечь текст из изображения
Выберите ваши изображения
Выберите файлы или перетащите их в извлекатель. JPG, PNG, WebP, GIF, BMP, AVIF и HEIC работают.
Выберите язык и извлеките
Выберите язык текста, затем нажмите Извлечь. Первый запуск на языке загружает его модель в ваш браузер.
Скопируйте или скачайте текст
Прочитайте результат, скопируйте его в буфер обмена или сохраните как .txt файл.
Почему LeanImg?
Большинство онлайн-сайтов OCR сначала просят вас загрузить изображение. Это странно принимать для удостоверения личности, платежной ведомости или подписанного контракта, и это больше не нужно, потому что современный браузер может выполнять распознавание самостоятельно. LeanImg извлекает текст из изображений полностью на вашем устройстве, поэтому ничего никуда не передается. Нет регистрации, нет водяных знаков и нет кредита за каждое изображение, который нужно купить, и он распознает латинский, кириллический, греческий, арабский и японский текст. Скриншоты и чистые сканы — это то, что он делает лучше всего, и мы говорим это прямо, а не обещаем идеальную точность на каждой фотографии. Исследуйте все наши бесплатные инструменты для изображений, чтобы сохранить остальную часть вашей работы в браузере тоже.
Работает на вашем устройстве
Изображение считывается, распознается и преобразуется в текст на этой странице. Ничего не загружается, поэтому конфиденциальные документы остаются конфиденциальными.
Бесплатно и без ограничений
Без регистрации, без кредитов, без водяных знаков и без платного уровня. Запускайте столько пакетов, сколько хотите, без затрат.
Читает несколько алфавитов
Поддерживаются латинский, кириллический, греческий, арабский и японский текст. Выберите язык, и движок загрузит соответствующую модель.
Как выглядят цифры
Заявления о точности дешевы, поэтому вот измерение. Шесть образцов прошли через этот движок, каждый с известным заранее текстом. Оценка — это сравнение символ за символом вывода с известным текстом. Образцы синтетические. Это HTML-страницы, отрендеренные в браузере и захваченные как реальные скриншоты, а ухудшенная строка — это тот же текст с CSS-размытием и поворотом, чтобы имитировать плохую съемку с телефона.
| Образец | Язык | Сходство | Уверенность |
|---|---|---|---|
| Чистый скриншот | Английский | 100.0% | 95 |
| Плотный абзац | Английский | 100.0% | 95 |
| Симулированная ухудшенная съемка | Английский | 92.4% | 65 |
| Русский образец | Русский | 100.0% | 96 |
| Японский образец | Японский | 100.0% | 93 |
| Фото без текста | Английский | 515 символов вымышленного текста | 32 |
Последнюю строку стоит прочитать дважды. Этот образец — темная фотография бабочек на мохнатом бревне, и в ней нет никакого текста. Движок вернул 515 символов текста, которого никогда не было. OCR-движки делают это. Они созданы для поиска форм символов, поэтому зернистость и текстура воспринимаются как символы, и в процессе нет этапа, который решает, что изображение пустое. Мы не заявляем о возможности обнаружить пустое изображение, потому что не можем. Каждый результат несет свою оценку уверенности, и предупреждение срабатывает, когда среднее значение падает ниже 60. Это фото получило 32, против 95 для чистого скриншота. Число — это то, что нужно прочитать, прежде чем доверять тексту.
Что загружается при первом использовании
Распознавание происходит на вашем устройстве, поэтому оборудование должно сначала загрузиться. Холодный старт на английском — это 3 запроса и около 6 МБ, что составляет рабочий процесс, ядро WebAssembly и английская модель. Все три загружаются с этого сайта, и ни один из них не является сторонним CDN. Ваш браузер кэширует их, поэтому второй запуск на этом языке начинается без необходимости что-либо загружать. Каждый следующий язык добавляет свою модель, от 0.6 до 2 МБ в зависимости от скрипта, и все девять вместе составляют около 11 МБ. Ничто не передается в обратном направлении: ваше изображение считывается на страницу и передается движку в памяти, и ни один запрос не передает его.
Где это работает и где это не работает
Скриншоты и чистые сканы — это хороший случай, и таблица показывает, насколько хорошо: три образца вернулись с 100.0%, символ за символом. Самая показательная строка — та, где снимок ухудшен. Размытие и небольшое вращение над тем же текстом стоили 7.6 пунктов сходства и снизили уверенность с 95 до 65, что достаточно низко, чтобы сработало предупреждение на карточке результата. Это примерно то, что делает спешная фотография страницы с телефона. Ручное письмо и текст, сфотографированные в сцене, такие как вывеска магазина или этикетка на полке, находятся вне того, для чего создан этот движок, и мы не делаем никаких заявлений о них. Дайте ему самый большой и четкий экземпляр, который у вас есть. Уменьшение скриншота сначала выбрасывает пиксели, из которых состоят символы, поэтому, если файл должен стать меньше, отправьте его в компрессор или изменитель размера, как только текст будет извлечен.
Часто задаваемые вопросы
Как работает извлечение текста из изображения?
OCR означает оптическое распознавание символов. Движок находит формы на вашем изображении, сопоставляет их с обученной моделью для выбранного вами языка и выводит распознанные символы. Все это происходит на этой странице. LeanImg использует Tesseract, движок OCR с открытым исходным кодом, скомпилированный в WebAssembly, чтобы он работал на вашем оборудовании, а не на сервере.
Загружается ли мое изображение на сервер?
Нет. Единственные запросы, которые делает извлекатель, касаются движка OCR и языковой модели, оба обслуживаются с этого сайта, и они движутся в одном направлении. Ваше изображение считывается с диска на страницу, передается движку в памяти и преобразуется в текст там. В кодовой базе нет конечной точки загрузки, чтобы его получить. Это важно, когда изображение является удостоверением личности, платежной ведомостью или подписанным контрактом. Откройте вкладку сети во время запуска: вы увидите, как загружаются файлы модели, и ничего, что унесло бы ваше изображение.
С каких форматов изображений я могу извлекать текст?
JPG, PNG, WebP, GIF и BMP идут прямо в движок. AVIF и HEIC декодируются на странице, прежде чем движок их увидит, так что фотография прямо с iPhone не требует предварительной конвертации. Что бы ни входило, обычный текст выходит.
Какие языки поддерживает OCR?
Английский, испанский, румынский, арабский, греческий, турецкий, индонезийский, русский и японский. Выберите язык перед извлечением, потому что движок сопоставляет формы с моделью, которую вы выбираете, и неправильная модель будет плохо считываться. Выбор начинается с языка страницы, на которой вы находитесь. Автоматического определения языка здесь пока нет.
Почему первый запуск загружает модель?
Потому что распознавание происходит на вашем устройстве, поэтому модель должна сначала туда попасть. В первый раз, когда вы используете язык, его файл данных загружается и кэшируется браузером, а последующие запуски на этом языке начинаются немедленно. Это цена за конфиденциальность. Облачный OCR-сервис отправляет ваше изображение на свой сервер, где хранится модель. Здесь наоборот: изображение остается у вас, а на устройство скачивается модель. Переход на язык, который вы еще не использовали, тоже скачивает свою модель.
Конвертер изображения в текст действительно бесплатен?
Да, бесплатно, без аккаунта и без счетчика использования. Нет регистрации, нет водяных знаков на тексте, нет кредитов и нет платного уровня, который бы сдерживал хорошую версию. Работа выполняется на вашем оборудовании, поэтому нет затрат на сервер за каждое изображение, которые мы могли бы передать вам.
Насколько точен процесс извлечения текста?
Это зависит от входных данных, и разница велика. Скриншоты и чистые сканы читаются очень хорошо, потому что символы четкие, равномерно освещенные и расположены прямо. Фотографии бумаги менее предсказуемы, и они становятся хуже при размытости, бликах, тенях или наклоне. Есть случаи, которые мы не будем притворяться, что можем обработать: рукописный текст и текст в сцене, такой как вывеска магазина или ярлык на полке. Этот движок создан для печатных символов. Другие сайты рекламируют идеальную точность на всем этом. Это утверждение не верно для любого движка OCR, включая этот, поэтому читайте вывод, прежде чем полагаться на него.
Сколько изображений я могу обрабатывать одновременно?
Вы можете выбрать пакет, и зона перетаскивания показывает лимит для одного запуска. Изображения обрабатываются последовательно, а не параллельно, и каждый результат появляется, как только он завершен, так что вы можете начать читать и копировать, пока остальные еще работают. Последовательная обработка также позволяет предсказать использование памяти на телефонах.
Что означает предупреждение о низкой уверенности?
Движок сообщает, насколько он уверен в каждом слове, которое он читает, и карточка результата показывает среднее значение для изображения. Когда это среднее значение падает ниже установленного нами порога, вы получаете предупреждение вместо чистого результата. Это не вердикт о том, что текст неверен. Это сигнал проверить его. На практике это происходит при размытых захватах, низком контрасте, очень мелком тексте и неправильном выборе языка.
Как я могу получить лучшие результаты OCR?
Дайте движку более крупные, четкие символы. Скриншотируйте источник, а не фотографируйте его, когда это возможно. Если вам нужно использовать камеру, снимайте прямо, а не под углом, заполняйте кадр текстом и поддерживайте равномерное освещение, чтобы не было бликов или теней на странице. Темный текст на светлом фоне читается лучше всего. Выберите правильный язык перед извлечением, так как этот выбор влияет на результат больше, чем что-либо другое в этом списке.
Могу ли я извлечь текст из скриншота?
Да, и скриншот — это лучший случай для этого инструмента. Это рендеренный текст: четкие края, плоский фон, нет линз и освещения, с которыми нужно бороться. Именно для этого создан движок OCR для печатного текста. Скриншоты сообщений об ошибках, потоков чата, диалогов приложений и вывода терминала проходят хорошо. Макет таблицы не восстанавливается, поэтому вы получаете слова, а не сетку.
Что я могу сделать с извлеченным текстом?
Скопируйте его в буфер обмена или скачайте как .txt файл. Когда вы обрабатываете пакет, вы также можете скачать все как один .txt. Здесь нет выходного формата в виде поискового PDF, и мы предпочли бы сказать это прямо, чем подразумевать: этот инструмент дает вам обычный текст, а не восстановленный документ с оригинальным макетом. Если вам нужны слова в таблице, документе или переводчике, вставьте их туда.
Есть еще вопросы? Узнайте больше о LeanImg и о том, как мы обрабатываем ваши изображения.
Нужны меньшие файлы? Сожмите ваши изображения, чтобы уменьшить размер файла. Нужен другой формат? Конвертируйте между форматами, такими как JPG, PNG, WebP и AVIF. Нужны другие размеры? Измените размер ваших изображений до точного размера.