清理修复 · 浏览器本地处理

PDF 文字识别(OCR)

识别扫描件里的中文和英文,输出处理后的 PDF 加一份可复制的识别文本,让图片型 PDF 变成能搜索、能复制的文档。

浏览全部工具
  • 01 本地计算
  • 02 完全免费
  • 03 无需登录
LOCAL WORKSPACE

你的文件,只在这里

本地模式
你的设备本地处理下载结果

没有“上传到服务器”这一步。

01 / TOOLS

27 个工具,打开就能用

覆盖日常最高频的 PDF 任务。可以按分类浏览,也可以直接搜索你要做的事。

02 / PRIVACY

不是“上传后删除”,
而是根本不上传。

浏览器内运行

PDF 解析、页面渲染和结果生成都由你的设备完成。

不保存文件

本站没有文件接收接口,也不会建立你的文档副本。

无账号体系

没有登录、没有上传历史、没有用户数据库。

依赖可审计

核心能力来自 MIT 与 Apache-2.0 许可的开源库。

03 / HOW TO USE

怎么用这个工具

识别扫描件里的中文和英文,输出处理后的 PDF 加一份可复制的识别文本,让图片型 PDF 变成能搜索、能复制的文档。

  1. 1
    选择扫描件 PDF

    单文件,可只识别指定页。

  2. 2
    选择识别语言

    中文简体 + 英文、仅中文、仅英文等组合。

  3. 3
    选择清晰度

    高清更准但更慢,页数多时可以分段处理。

  4. 4
    开始识别

    结果打包为 ZIP,含处理后的 PDF 与识别文本。

04 / FAQ

关于OCR 文字识别

识别准确率怎么样?

扫描清晰、字体规整的印刷体文档效果较好。手写体、低分辨率扫描件、复杂表格的识别率会明显下降。

为什么第一次用比较慢?

首次需要加载识别引擎和语言模型(约十几 MB,来自本站服务器,之后浏览器会缓存)。之后的识别只是计算耗时。

结果里都有什么?

一个 ZIP,里面包含处理后的 PDF 和一份识别出的文本文件。识别过程完全在你的设备上完成,文件不会上传。

05 / FAQ

你可能想问

文件真的不会上传吗?

是。处理通过浏览器中的 JavaScript、Canvas 与 WebAssembly 完成,本站不接收你的 PDF 或图片文件。刷新页面后一切都从内存中消失。

为什么压缩后文字不能搜索了?

当前压缩会把每一页重新渲染为图片,再以较低质量写入新 PDF,适合扫描件与图片型文档。文字型 PDF 建议用其他工具,避免失去文本层、链接和表单。

加密后的 PDF 真的安全吗?

使用 AES-256,密码不会离开你的设备,也无法被找回。请务必自己记住密码——我们没有服务端,忘记密码就无法恢复。

OCR 识别准确率如何?

扫描清晰、字体规整的文档效果较好。首次使用会下载识别模型,之后浏览器会缓存。手写体与低分辨率扫描件识别率会明显下降。

大文件处理失败怎么办?

浏览器处理受设备内存限制。建议关闭其他大型应用,或先用拆分工具分段处理。移动端建议单文件控制在 30 MB 以内。

支持加密 PDF 吗?

支持。遇到加密文件时会提示你输入密码;解密工具会输出不带密码的副本。我们不会尝试绕过你无权访问的文档权限。

LOCAL TOOL

合并 PDF

选择 PDF 文件

拖到这里,或点击从设备选择

单个文件建议不超过 100 MB
PDF 预览
/0 适应