在浏览器中运行

图片转文字

把照片、截图或扫描件里的文字提取出来 —— 全程在浏览器内完成,不会上传。

本地处理0 上传约 1.2 秒无需账号

不上传任何东西

OCR 引擎就在这个页面里运行。你的证件、发票或合同不会离开设备。

小图会自动放大

偏小的截图会被放大到引擎需要的字高,而不是被退回来让你重拍。

多种语言同时识别

中英混排的截图一次读完,而不是只选一种语言、丢掉另一半。

一次最多 20 张

整批处理并一起下载结果。无需账号,也没有每日上限。

一句话: 要从图片里提取文字,把照片或截图拖进来,选好图中包含的语言,就能拿到文本。全程在浏览器里进行,不会上传。如果是扫描件或斜着拍的照片,把清理选项开着 —— 它比你选哪个工具更重要。

同一张图,为什么不同网站给出不同结果

有件事各家的宣传页都不会提:多数能从图片里提取文字的免费工具,跑的是同一个开源引擎 Tesseract,只是编译成了 WebAssembly。我们实测了十家,其中至少五家自己就写明了这一点。所以当同一张图在一个站上出来干净的文本、在另一个站上出来一堆乱码时,引擎很少是那个变量。

真正有差别的,是送到引擎面前的东西。而其中最要紧的那个因素没人拿来宣传:字母有多少像素高。Tesseract 想要小写字母大约 20 像素高。一张在几个聊天软件之间转发过的截图,或者为了上传而被压小的照片,往往只有这个高度的一半 —— 准确率会断崖式下跌。

其他工具会让你怎么做

重拍一张。我们测的十家里,遇到结果不好时给出的常规建议就是用更高的分辨率重新拍摄或重新截图。这建议本身没错,但当那张图是你手上唯一一张时,它毫无用处。

这一页的做法是先把偏小的图放大再识别,并且明确告诉你它这么做了。实测中,一张 400 × 184 像素的截图 —— 小到多数工具会让你重来 —— 得到了 94% 的把握度,每一行都正确。放大并不能凭空造出从未被拍下的细节,但它能给引擎它原本就为之设计的字高。

OCR 到底做了什么,又没做什么

光学字符识别会观察图像中明暗像素的排布,推断这些形状最可能对应哪些字符。它并不阅读、也不理解这一页 —— 它是在把形状一个一个地匹配成字母。

这个区别几乎能解释人们对 OCR 的所有抱怨。为什么一个用了少见字体的词会认错,为什么咖啡渍后面的字母变成了另一个字母,以及为什么引擎会心安理得地给出一个看起来很确定、实际上并不存在的词。它是模式匹配,不是理解。

这也解释了为什么但凡能从图片里提取文字的工具,引擎都会为输出的每一个词报一个把握度分数。这些分数是真实的信息,而这一页会把它显示出来:当平均值低于 70% 时,结果会被标出来,而不是当成确凿无疑的东西交给你。多数工具把这个数藏起来了。

人们实际上拿它做什么

截图与报错信息

从别人发来的截图里、或从无法选中的错误对话框里,把文字复制出来。

收据与发票

从拍下的收据上取出金额和单号,而不是一个个重新敲进表格。

拍下来的纸页

把一张印刷页、书页或表格的照片,变成可搜索、可编辑、可粘贴的文字。

本就不该上传的文件

证件、诊断书、合同。这些恰恰是最值得留在自己设备上、别送去别人服务器的图片。

如何从图片中提取文字

从图片里提取文字只需三步。无需安装、无需账号,也没有上传这一步。首次运行会把 OCR 引擎和你选的语言数据下载进浏览器缓存,之后即使离线也能用。

  1. 1

    添加图片

    拖入照片、截图或扫描件 —— JPG、PNG、WebP、BMP 和 GIF 都支持。一次最多可加 20 张,它们会被逐张处理。

  2. 2

    选好语言和清理选项

    把图中出现的每一种语言都选上,而不只是主要那种。扫描件和照片建议保持清理选项开启;截图本来就干净,可以关掉。只有斜着拍的页面才需要打开摆正。

  3. 3

    提取,然后核对并复制

    每张图的文字会出现在一个可编辑的框里,并附带把握度。你可以复制、下载成 .txt,或把全部打包成 ZIP。请务必对照原图快速扫一遍 —— OCR 的结果即使是错的,看起来也很笃定。

引擎与语言数据在首次运行后即被缓存,所以处理第二张图时会立刻开始识别。

决定成败的三件事

从图片里提取文字时,结果不好几乎总是这三件事之一 —— 而第一件比后两件加起来还重要。

分辨率,而且领先一大截

Tesseract 想要小写字母大约 20 像素高,对于整页文字来说,这意味着图像短边应该在一千像素上下。低于这个数,准确率会明显下滑。这一页会在识别前把偏小的图放大,并告诉你它这么做了 —— 实测中一张 400 × 184 的截图仍然每一行都正确。话说回来,放大一张模糊的照片,只会得到一张更大的模糊照片。如果你还能重拍,就让页面占满取景框:这比这个站或任何其他站上的任何设置都管用。

对比度,以及为什么清理的作用没你想的大

引擎需要把墨迹和纸张分开,所以发灰的扫描件、或半边落着阴影的页面会让它更吃力。清理选项会用局部自适应阈值把图像转成黑白 —— 阈值是按区域分别算的,而不是整张图算一次,这正是光照不均的照片所需要的。把效果的量级说清楚:现代 Tesseract 内部本来就做二值化,所以在光线尚可的照片上,差别很小。我们的实测中它让把握度动了几个百分点,偶尔还多出一个杂字符。它值得存在,是为了真正发灰的扫描件和光线差的手机照片,而不是为了截图。

角度,只对拍下来的页面有意义

OCR 是按水平行来读的,所以一页歪上几度,词就会横跨引擎正在扫描的那几行像素。摆正会先检测主要文字方向并把图转回去。手持斜拍的东西请打开它。截图和平板扫描件请关掉 —— 那里没有倾斜可纠,检测只会引入误差。

诚实的结论是:先用你手上最大、最清晰的那个版本。然后,扫描件或昏暗照片再开清理,斜拍的再开摆正。这两样都救不回一张本来就太小的图。

包含多种语言的截图 —— 这件事没有第二家在做

这一点常常让人栽跟头。我们测过的每一家,都要求你在提取前选定一种语言。对一页纯英文来说没问题,但现实中大量图片并非如此:带英文商品名的中文发票、带拉丁字母品牌名的日文界面、引用了英文网址的俄文文档。

只选一种语言,那么任何想识别图中另一种文字区域的尝试都会做得很差 —— 不是因为引擎看不见那些字符,而是因为它在用错误的模型去匹配。你会拿到一半的文字,以及本该是另一半的位置上的一堆无意义内容。

Tesseract 可以同时加载多个语言模型,而这一页允许你选任意多种。我们测过的十家工具里,没有一家提供这个能力:每一家都要求你在提取前只认准一种语言。代价也如实说清:每多一种语言,首次使用时要下载的数据就多一些,同时加载多种也会让识别慢一点。请只选图中实际出现的那几种,而不是把列表全勾上。

这个工具做不到的事

OCR 有实打实的限制,而在你从图片里提取文字之前先知道它们,比任何设置都更省时间。

手写,尤其是连笔

Tesseract 是按印刷体训练的。工整的印刷体大写字母有时能认出来;日常的连笔手写通常不行。这是引擎本身的限制,不是这一页的,而且它适用于每一个基于 Tesseract 的免费工具 —— 也就是绝大多数 —— 只是多数不会告诉你。

格式与排版

你拿到的是纯文本。粗体、斜体、标题、颜色和字体全部会被丢掉。表格会失去结构变成一行行词,分两栏的页面可能被横着读完而不是一栏一栏读。

救回一张真正拍坏的照片

清理能改善一张中等的图,却无法凭空造出从未被拍下的细节 —— 一张模糊、昏暗或很小的小字照片不会因此变得可读。用更高的分辨率重拍,胜过任何处理。

看懂这份文件

它按阅读顺序返回它看见的字符,仅此而已。它不知道哪个数字是总额、哪一行是日期。凡是你要据此行事的内容,都请核对。

免费工具横向对比

十家能从图片里提取文字的工具,2026 年 9 月逐家实际使用后记录。仅列免费档的行为,而且只列有差别的项 —— 它们全都免费,多数也都在浏览器内运行。

工具在哪里处理批量多语言同时
本页你的浏览器最多 20 张支持 —— 任意组合
PixConvert你的浏览器一次一张不支持 —— 只能单选
UtiloKit你的浏览器一次一张不支持 —— 只能单选
OpenConvert你的浏览器支持不支持 —— 只能单选
Pixellize你的浏览器一次一张不支持 —— 只能单选
imagetotext.info未说明付费档不支持 —— 只能单选
OnlineOCR.net它们的服务器需登录不支持 —— 只能单选

诚实的总结是:这些图片转文字工具里有好几个都相当不错,而在浏览器内运行的那几家值得肯定 —— 那曾经是差异化,如今不再是了。仍有两件事存在差别:能不能一次交给它一整批,以及能不能一次读完混着多种文字的图。在后一件上,我们没有找到第二家能做到的。

所有工具 100% 免费且安全

完整的 PDF 工具套件

探索我们全面的 PDF 工具集合,旨在处理您的所有文档需求

工具索引 · 47
01

PNG 转 PDF

将 PNG 图片合并为单个可打印的 PDF

Avg 1.2s本地
02

JPG 转 PDF

将 JPG 图片转换为 PDF 格式

Avg 1.4s本地
03

合并 PDF

将多个 PDF 文件合并为一个

Avg 0.8s本地
04

压缩 PDF

高效减小 PDF 文件大小

Avg 2.1s本地
05

PDF 转 PNG

将 PDF 页面转换为 PNG 图片

Avg 1.6s本地
06

PDF 转 JPG

将 PDF 页面转换为 JPG 图片

Avg 1.5s本地
07

PDF 转文本

从 PDF 文件中提取文本内容

Avg 0.9s本地
08

拆分 PDF

将 PDF 拆分为单独的页面

Avg 0.6s本地
09

编辑 PDF

编辑和注释 PDF 文档

Beta本地
10

整理 PDF

整理和重新排列 PDF 页面

Avg 0.7s本地
11

旋转 PDF

旋转 PDF 页面并永久保存

Avg 0.5s本地
12

页码

为 PDF 添加页码并实时预览

Avg 0.6s本地
13

PDF 水印

为 PDF 添加文字水印并实时预览

Avg 0.6s本地
14

HEIC 转 JPG

将 iPhone 的 HEIC 照片转换为 JPG

Avg 1.0s本地
15

删除PDF页面

删掉不需要的页面,下载干净的 PDF

Avg 0.5s本地
16

PDF 提取页面

把选中的页面保存为新 PDF 或单独文件

Avg 0.5s本地
17

PDF 签名

手绘、键入或上传签名,放置到任意页面

Avg 1.0s本地
18

调整PDF大小

把页面尺寸改成 A4、Letter 或自定义大小

Avg 0.6s本地
19

裁剪 PDF

修剪页边距、拖拽框选,或一键去除白边

Avg 0.6s本地
20

拍平 PDF

把表单变为只读——文字保持可搜索,或锁定为图像

Avg 0.7s本地
21

PDF 元数据

查看、编辑或清除作者、标题、日期等元数据

Avg 0.4s本地
22

PDF 转灰度

转为灰度或黑白,打印时节省彩色墨水

Avg 1.8s本地
23

从 PDF 提取图片

把 PDF 内嵌的照片提取出来,保存为 PNG 或 JPG

Avg 0.9s本地
24

WebP 转 PDF

把 WebP 图片转换为 PDF,多张可合并成一个文件

Avg 0.7s本地
25

PDF 加密码

在浏览器中为 PDF 设置打开密码,全程本地完成

Avg 0.3s本地
26

PDF 解除密码

在浏览器中移除 PDF 的已知密码或限制

Avg 1.5s本地
27

HEIC 转 PDF

将 iPhone 的 HEIC 照片转换为 PDF

Avg 0.8s本地
28

AVIF 转 PDF

将 AVIF 图片转换为 PDF

Avg 0.7s本地
29

TIFF 转 PDF

将 TIFF 图片和扫描件转换为 PDF

Avg 1.0s本地
30

BMP 转 PDF

将 BMP 位图转换为 PDF

Avg 0.7s本地
31

PDF 文字识别

让扫描版 PDF 可被搜索,全程在浏览器完成

Avg 2s/page本地
32

PDF 涂黑

把 PDF 里的敏感内容真正删除,全程在浏览器完成

Avg 0.3s/page本地
33

图片压缩

批量压缩 JPEG、PNG、WebP,全程在浏览器完成

Avg 0.2s本地
34

调整图片尺寸

批量调整图片尺寸,内置常用预设,全程在浏览器完成

Avg 0.2s本地
35

PNG 转 JPG

把 PNG 批量转成 JPG,下载前就能看到输出体积

Avg 0.2s本地
36

JPG 转 PNG

把 JPG 批量转成 PNG,可顺便把纯色背景抠成透明

Avg 0.3s本地
37

WebP 转 JPG

把 WebP 批量转成 JPG,动画 WebP 可导出每一帧

Avg 0.3s本地
38

WebP 转 PNG

把 WebP 转成 PNG 并保留透明,也可以顺手抠掉纯色背景

Avg 0.3s本地
39

图片转 WebP

把 JPG、PNG 等批量转成 WebP,还能压到指定的 KB 数

Avg 0.2s本地
40

SVG 转 PNG

按任意尺寸光栅化 SVG,也能用一个 logo 生成整套图标

Avg 0.2s本地
41

AVIF 转 JPG

把 AVIF 转成到处都能打开的 JPG,也能压到指定的 KB 数

Avg 0.3s本地
42

PDF 对比

看清两版 PDF 之间到底改了什么,两份文件都不上传

Two files, no upload本地
43

SVG 转 JPG

按任意尺寸把 SVG 光栅化成 JPG,并自己决定透明处填什么颜色

Pick size and background本地
44

GIF 转 PNG

取一张静帧,或者把动画 GIF 拆成每帧一张编号 PNG

Every frame at once本地
45

GIF 转 JPG

自己决定用什么替代透明,取一帧或全部 —— 该转 PNG 的时候我们会直说

You pick the background本地
46

PDF 转 TIFF

将 PDF 转换为单个多页 TIFF

One multi-page file本地
47

图片转文字

从照片和截图中提取文字

11 languages, offline本地

关于从图片中提取文字

人们在从图片里提取文字并据此行事之前,真正会问的那些。

免费吗?有什么限制?

免费,不用账号、没有每日上限、也没有水印。 一次可处理 20 张,每张 25 MB 以内。这个限制的存在是因为 OCR 很吃 CPU,而且跑在你自己的机器上 —— 不是因为有付费档。处理完接着再来一批就行。

我的图片会被上传到什么地方吗?

不会。OCR 引擎就在这个页面里运行。 你的图片由你自己的浏览器读取,不会被传出去。这一点在这里比在多数转换里更要紧,因为人们拿去做 OCR 的图,往往是证件、发票、诊断书和合同。

为什么第一次用会下载好几 MB?

那是 OCR 引擎和语言数据,而且只会发生一次。 正因为识别跑在本地而不是服务器上,引擎必须先到达你的设备。之后它会被缓存,所以后续使用立刻就能开始 —— 而且离线也能用。

能识别手写吗?

不可靠,连笔通常完全不行。 引擎是按印刷体训练的。工整的印刷体大写字母有时能读出来。所有基于 Tesseract 的免费工具都是如此,而那几乎是全部。

识别出来是错的,我该改什么?

先看分辨率,再看清理,最后才是角度。 从图片里提取文字时,一个更大更清晰的源图胜过任何设置 —— 差距还不小。其次,发灰的扫描件或昏暗的照片再打开清理,斜着拍的再打开摆正。如果图里有两种文字,请把两种语言都选上,而不是猜哪种占多数。

图里有两种语言也能处理吗?

可以 —— 请把出现的每一种都选上,而不只是主要那种。 引擎会一次加载多个模型,在同一遍里读完两种文字。多数其他工具要求你只能选一种,这正是混排截图在它们那里只回来一半的原因。

会保留排版、表格或粗体吗?

不会。输出是纯文本。 格式、颜色和字体都会被丢掉,表格会失去结构,多栏页面可能被横着读而不是一栏一栏读。如果你需要保留排版,那你要的是一份带文本层的 PDF,而不是提取出来的文字。

如果我手上是 PDF 而不是图片呢?

请改用 PDF OCR 工具 —— 它会保持页面完好。 它会渲染每一页、识别、再把一层看不见的文本写回原页,于是文档看上去毫无变化却变得可搜索。先把 PDF 转成图片再丢进这里,会丢掉文档结构。

相关工具

在你从图片里提取文字的前后可能还会用到的东西,全部免费,也全部在你自己的设备上运行。

  • PDF OCR 针对文档而不是图片 —— 加一层可搜索的文本,并保持页面完好。
  • PDF 转文本 当 PDF 里本来就有真正的文字、只需要取出来时,不需要 OCR。
  • 调整图片尺寸 识别前放大一张偏小的截图,或缩小一张过大的照片。
  • 压缩图片 图本身没问题、只是文件太大发不出去的时候用。
  • PDF 转 PNG 把 PDF 的页面取成图片 —— 当你要的是画面而不是文字时。