PDF 解析、页面渲染和结果生成都由你的设备完成。
PDF 文字识别(OCR)
识别扫描件里的中文和英文,输出处理后的 PDF 加一份可复制的识别文本,让图片型 PDF 变成能搜索、能复制的文档。
- 01 本地计算
- 02 完全免费
- 03 无需登录
你的文件,只在这里
没有“上传到服务器”这一步。
27 个工具,打开就能用
覆盖日常最高频的 PDF 任务。可以按分类浏览,也可以直接搜索你要做的事。
没有匹配的工具,换个关键词试试。
不是“上传后删除”,
而是根本不上传。
本站没有文件接收接口,也不会建立你的文档副本。
没有登录、没有上传历史、没有用户数据库。
核心能力来自 MIT 与 Apache-2.0 许可的开源库。
怎么用这个工具
识别扫描件里的中文和英文,输出处理后的 PDF 加一份可复制的识别文本,让图片型 PDF 变成能搜索、能复制的文档。
- 1选择扫描件 PDF
单文件,可只识别指定页。
- 2选择识别语言
中文简体 + 英文、仅中文、仅英文等组合。
- 3选择清晰度
高清更准但更慢,页数多时可以分段处理。
- 4开始识别
结果打包为 ZIP,含处理后的 PDF 与识别文本。
关于OCR 文字识别
识别准确率怎么样?
扫描清晰、字体规整的印刷体文档效果较好。手写体、低分辨率扫描件、复杂表格的识别率会明显下降。
为什么第一次用比较慢?
首次需要加载识别引擎和语言模型(约十几 MB,来自本站服务器,之后浏览器会缓存)。之后的识别只是计算耗时。
结果里都有什么?
一个 ZIP,里面包含处理后的 PDF 和一份识别出的文本文件。识别过程完全在你的设备上完成,文件不会上传。
你可能想问
文件真的不会上传吗?
是。处理通过浏览器中的 JavaScript、Canvas 与 WebAssembly 完成,本站不接收你的 PDF 或图片文件。刷新页面后一切都从内存中消失。
为什么压缩后文字不能搜索了?
当前压缩会把每一页重新渲染为图片,再以较低质量写入新 PDF,适合扫描件与图片型文档。文字型 PDF 建议用其他工具,避免失去文本层、链接和表单。
加密后的 PDF 真的安全吗?
使用 AES-256,密码不会离开你的设备,也无法被找回。请务必自己记住密码——我们没有服务端,忘记密码就无法恢复。
OCR 识别准确率如何?
扫描清晰、字体规整的文档效果较好。首次使用会下载识别模型,之后浏览器会缓存。手写体与低分辨率扫描件识别率会明显下降。
大文件处理失败怎么办?
浏览器处理受设备内存限制。建议关闭其他大型应用,或先用拆分工具分段处理。移动端建议单文件控制在 30 MB 以内。
支持加密 PDF 吗?
支持。遇到加密文件时会提示你输入密码;解密工具会输出不带密码的副本。我们不会尝试绕过你无权访问的文档权限。