离线 OCR:图片转文字,不上传
用在浏览器里运行的 OCR 引擎从截图和照片中提取文字。图片不会离开你的设备;首次加载后,识别甚至可以离线进行。
1. 图片
2. 提取的文字(可直接编辑)
提示:图片以中文为主时选「中文为主」更准——中英混排模式遇到 -、-> 等符号时可能把整段中文误判成英文。图片越清晰识别越准。
怎么把图片变成文字
- 添加图片——截图后直接 ⌘V 粘贴,或把图片拖进上方虚线框,也可以点击选择文件。
- 选择识别语言——图片以中文为主选「中文为主」,中英混排选「中英混排」,纯英文选「仅英文」。
- 点「提取文字」——首次运行会下载 OCR 引擎(约几 MB),之后使用即刻开始。
- 编辑并导出——结果可直接在框里修改,然后复制文字或下载为 .txt 文件。
什么时候用得上
从截图里抄文字。报错弹窗、课件 PPT、聊天记录——能看到但选不中的内容,截个图粘贴进来,几秒钟变成可编辑的文字,不用手打一遍。
私下数字化纸质文件。合同、发票、病历这类敏感内容不适合传到陌生服务器。本工具识别全程在你自己设备上运行——页面加载完后甚至可以断网使用。
在受限电脑上应急。公司或学校的电脑装不了 OCR 软件?网页打开即用,无需安装、无需注册。
注意事项
- 支持常见图片格式(PNG、JPEG、WebP、GIF、BMP),包括剪贴板截图。
- 清晰、水平、印刷体的文字效果最好;手写体、花哨字体、倾斜拍摄和过低分辨率会明显降低准确率。
- OCR 引擎(Tesseract.js)和语言包只需下载一次,浏览器缓存后全程本地运行。
接下来可以做什么
操作步骤
- 联网打开一次本页,让 OCR 引擎下载并缓存到本地。
- 拖入截图或照片,也可以直接从剪贴板粘贴。
- 选择文字语言后开始识别——处理在你的设备上完成。
- 复制或下载识别结果,图片全程不会被上传。
适用场景
- 从合同、病历等机密文件中提取文字。
- 调试时从截图里复制报错信息或代码。
- 在飞机等无网环境下从扫描页摘录内容。
- 处理公司规定禁止上传的图片资料。
限制与说明
- 首次识别需要联网下载 OCR 引擎;之后完全本地运行。
- 手写体和过低分辨率会降低准确率,这与其他 OCR 一样。
- 识别在浏览器中逐页进行,超大图片耗时更长。
隐私设计
OCR 通常意味着把图片发给云端 API。这里的识别引擎(编译为 WebAssembly 的 Tesseract)在你的浏览器标签页内运行。唯一的网络请求是一次性的引擎下载;图片从磁盘读入内存,从不传输。
常见问题
怎么在线把图片转成文字又不上传?
用识别过程在浏览器本地完成的工具——比如本页。粘贴或拖入图片,点「提取文字」,识别在你的设备上运行。可以验证:页面加载完后断网,依然能用。
支持哪些语言?
简体中文和英文,可单独或混排识别。图片以中文为主时选「中文为主」更准——混排模式遇到 -、-> 等符号时可能把整段中文误判成英文。
我的图片会上传到服务器吗?
不会。OCR 引擎(Tesseract.js)通过 WebAssembly 完全在你的浏览器里运行——页面加载完成后甚至可以断网使用。
为什么第一次使用比较慢?
OCR 引擎与语言包(约几 MB)由 Pocketful 同源提供,首次加载后浏览器会缓存,再次使用通常无需重新下载。
什么样的图片识别效果好?
文字清晰、水平、大小适中的截图效果最好。手写体、花哨字体、倾斜拍摄和过低的分辨率会明显降低准确率。
想把表格截图直接变成 Markdown?
用我们的表格截图 → Markdown 工具——自动识别行列,输出可直接粘贴的 Markdown 表格。