LeanImg

图像转文本 — 免费在线 OCR

直接在您的浏览器中提取截图、扫描和文档照片中的文本。免费,无需注册,未上传任何内容。

正在加载文本提取器...

想要感谢我们?告诉您的朋友关于 LeanImg 的事!

如何从图像中提取文本

1

选择您的图像

选择文件或将其拖放到提取器中。JPG、PNG、WebP、GIF、BMP、AVIF 和 HEIC 都可以。

2

选择语言并提取

选择文本的语言,然后单击提取。第一次在某种语言中的运行会将其模型下载到您的浏览器。

3

复制或下载文本

阅读结果,将其复制到剪贴板或保存为 .txt 文件。

为什么选择 LeanImg?

大多数在线 OCR 网站要求您先上传图片。这对于身份证、工资单或签署的合同来说是一个奇怪的接受方式,而这已经不再必要,因为现代浏览器可以自行进行识别。LeanImg 完全在您的设备上提取图像中的文本,因此没有任何内容被传输到其他地方。无需注册,无水印,也没有每张图像的积分购买,并且它可以读取拉丁文、西里尔文、希腊文、阿拉伯文和日文文本。截图和清晰扫描是它的强项,我们明确表示,而不是承诺在每张照片上都能达到完美的准确性。探索我们所有的免费图像工具,以便在浏览器中继续进行其余工作。

在您的设备上运行

图像在此页面内被读取、识别并转换为文本。没有任何内容被上传,因此私密文档保持私密。

免费且无限制

无需注册,无积分,无水印,也没有付费层。可以无限制地运行多个批次,且没有费用。

支持多种脚本

支持拉丁文、西里尔文、希腊文、阿拉伯文和日文文本。选择语言后,引擎会加载匹配的模型。

数字的样子

准确性声明很便宜,所以这里是测量结果。六个样本经过了这个引擎,每个样本的文本都是提前已知的。得分是输出与已知文本逐字符比较的结果。这些样本是合成的。它们是浏览器中呈现的HTML页面,并作为真实的截图捕获,而降级行是同一文本在CSS模糊和旋转下的样子,因此它模仿了糟糕的手机捕获。

2026-08-11在桌面硬件上的真实运行测量。日语得分是在间距标准化的情况下获得的,因为引擎在字符之间放置了空格。持续时间故意省略,因为手机比这些运行的机器慢。
样本语言相似度置信度
清晰截图英语100.0%95
密集段落英语100.0%95
模拟降级捕获英语92.4%65
俄语样本俄语100.0%96
日语样本日语100.0%93
没有文本的照片英语515个虚构文本字符32

最后一行是需要读两遍的。该样本是一张黑暗的蝴蝶照片,拍摄在苔藓覆盖的原木上,照片中没有任何文字。引擎返回了515个从未存在的文本字符。OCR引擎就是这样工作的。它们被设计用来寻找字符形状,因此颗粒和纹理被报告为字符,并且在管道中没有阶段决定图像是空白的。我们不声称能够检测空图像,因为我们无法做到。每个结果都有其置信度分数,当平均值低于60时会触发警告。该照片得分为32,而清晰截图得分为95。在你相信文本之前,数字是需要阅读的内容。

首次使用时下载的内容

识别在您的机器上运行,因此机械设备必须先到达。英语的冷启动是3个请求和大约6 MB,这包括工作者、WebAssembly核心和英语模型。这三者均来自此站点,并且都不是第三方CDN。您的浏览器会缓存它们,因此在该语言的第二次运行时没有内容需要获取。每种进一步的语言添加其自己的模型,大小在约0.6到2 MB之间,所有九种语言加起来大约为11 MB。没有任何内容以相反的方式传输:您的图像被读取到页面中并在内存中交给引擎,没有请求将其传出。

它的工作范围和失败范围

截图和清晰扫描是好的案例,表格显示了它的好处:三个样本的返回率为100.0%,逐字符比较。降级行是有用的。对同一文本进行模糊处理和小幅旋转使相似度降低了7.6个百分点,置信度从95降至65,这足以触发结果卡上的警告。这大致是匆忙拍摄的页面照片所造成的。手写和场景中拍摄的文本,例如商店标志或货架标签,超出了该引擎的设计范围,我们对此不做任何声明。给它您拥有的最大、最清晰的副本。首先缩小截图会丢弃字符所由的像素,因此如果文件必须变小,请在文本提取后将其发送到压缩器或调整大小工具。

常见问题

图像转文本提取是如何工作的?

OCR 代表光学字符识别。引擎在您的图片中找到形状,将其与您选择的语言的训练模型进行匹配,并输出识别到的字符。所有这些都发生在此页面内。LeanImg 使用 Tesseract,这是一款开源的 OCR 引擎,编译为 WebAssembly,因此它在您的硬件上运行,而不是在服务器上。

我的图像会被上传到服务器吗?

不会。提取器发出的唯一请求是针对 OCR 引擎和语言模型,这两者均来自此网站,并且它们是单向传输。您的图像从磁盘读取到页面,交给内存中的引擎并在此转换为文本。代码库中没有上传端点来接收它。当图像是身份证、工资单或签署的合同时,这一点很重要。在运行期间打开您的网络选项卡:您将看到模型文件到达,而没有任何内容传送您的图像。

我可以从哪些图像格式中提取文本?

JPG、PNG、WebP、GIF 和 BMP 直接传递给引擎。AVIF 和 HEIC 在引擎看到它们之前在页面中解码,因此直接从 iPhone 拍摄的照片无需先转换。无论输入什么,输出都是纯文本。

OCR 支持哪些语言?

英语、西班牙语、罗马尼亚语、阿拉伯语、希腊语、土耳其语、印尼语、俄语和日语。在提取之前选择语言,因为引擎会根据您选择的模型匹配形状,错误的模型读取效果差。选择器从您所在页面的语言开始。这里尚未实现自动语言检测。

为什么第一次运行会下载模型?

因为识别发生在您的设备上,因此模型必须先到达。第一次使用某种语言时,其数据文件会下载并缓存到浏览器中,后续在该语言中的运行会立即开始。这是隐私的交换。托管的 OCR 服务会上传您的图像并将模型保留在自己的机器上。而这个服务保留您的图像并获取模型。切换到您尚未使用的语言也会下载该模型。

图像转文本转换器真的免费吗?

是的,免费,无需账户和使用计数器。无需注册,文本上没有水印,没有积分,也没有付费层限制良好版本。工作在您的硬件上运行,因此我们没有每张图像的服务器成本转嫁给您。

文本提取的准确性如何?

这取决于输入,差异很大。截图和清晰扫描的读取效果非常好,因为字符清晰、光线均匀且直立。纸张的照片则不那么可预测,模糊、眩光、阴影或倾斜角度会使效果更差。有些情况我们不会假装可以处理:手写和场景中的文本,例如商店标志或货架上的标签。这个引擎是为打印字符而构建的。其他网站宣传在所有方面的完美准确性。这个说法对任何 OCR 引擎都不成立,包括这个,因此在依赖输出之前请先阅读。

我一次可以处理多少张图像?

您可以选择一个批次,拖放区显示单次运行的限制。图像是按顺序处理而不是并行处理的,每个结果在完成后立即显示,因此您可以在其余图像仍在处理时开始阅读和复制。顺序处理还可以在手机上保持内存使用的可预测性。

低置信度警告是什么意思?

引擎报告它对每个读取单词的确定程度,结果卡显示图像的平均值。当该平均值低于我们设定的阈值时,您会收到警告,而不是干净的结果。这不是文本错误的裁决。这是一个检查的信号。在实际操作中,它会在模糊捕获、低对比度、非常小的文本和错误的语言选择时触发。

我如何获得更好的 OCR 结果?

给引擎提供更大、更清晰的字符。尽可能截图源文件,而不是拍照。如果必须使用相机,请正对拍摄,而不是倾斜,填满画面中的文本,并保持光线均匀,以免眩光或阴影遮挡页面。深色文本在浅色背景上读取效果最佳。在提取之前选择正确的语言,因为这一选择比列表上的其他任何内容更能改变结果。

我可以从截图中提取文本吗?

可以,截图是此工具的最佳案例。它是渲染文本:清晰的边缘、平坦的背景,没有镜头和光线干扰。这正是打印文本 OCR 引擎所构建的读取内容。错误消息、聊天记录、应用对话框和终端输出的截图都能很好地通过。表格布局不会被重建,因此您得到的是单词,而不是网格。

我可以对提取的文本做什么?

将其复制到剪贴板,或将其下载为 .txt 文件。当您处理一个批次时,您还可以将所有内容下载为一个单独的 .txt。这里没有可搜索的 PDF 输出,我们宁愿明确说明,而不是暗示:此工具为您提供纯文本,而不是带有原始布局的重建文档。如果您需要将文本放入电子表格、文档或翻译器中,请将其粘贴到那里。

还有其他问题吗?了解更多关于 LeanImg 以及我们如何处理您的图像。

需要更小的文件吗?压缩您的图像以减少文件大小。需要不同的格式吗?在格式之间转换,如 JPG、PNG、WebP 和 AVIF。需要不同的尺寸吗?调整您的图像大小到确切的尺寸。