OCR 文字识别
为扫描件 PDF 添加真正的文字层,让其中的文字可以搜索、选择和复制。识别完全在您自己的设备上进行——文档绝不离开它。
- 无需上传
- 本地运行
- 无需注册
本次会话上传的文件数据:0 B
您的文件在浏览器本地处理——不会有任何内容被上传。
如何对 PDF 进行 OCR 识别
- 将扫描件 PDF 拖到上传区域,或点击选择文件(最大 100 MB)。
- 选择识别质量:标准(200 DPI)适合大多数文档;精细(300 DPI)有助于小号字体;快速(150 DPI)速度最快。
- 点击“OCR 文字识别”。首次运行会下载一次识别引擎,之后即可瞬间启动。
- 下载可搜索的 PDF——页面不变,但多了真正的文字层——或者只下载提取出的文本。
OCR 识别机密扫描件,无需发送到任何地方
扫描件往往正是最敏感的那类文档:已签署的合同、病历、身份证件复印件、旧信件。大多数在线 OCR 服务都要求您先把它们上传。CoolPDF 改为在您的浏览器标签页中运行识别引擎——编译为 WebAssembly 的 Tesseract。文档在您自己的设备上被读取和处理,没有任何一个字节经过网络。您可以在它工作时打开浏览器的网络面板亲自验证。因为没有服务器在做这件事,所以也没有页数额度、没有每日上限:唯一的限制就是您的设备。
常见问题
它能识别哪些语言?
目前支持英文(拉丁字母)。 其他语言需要各自的训练数据文件,本版本尚未包含——多语言支持已在计划中。重音符号和常见的欧洲标点都能正常处理。
已经有文字层的 PDF 还需要 OCR 吗?
不需要,本工具面向没有文字层的扫描件和图片。 如果您的 PDF 已有可选择的文字,直接使用“PDF 转 Markdown”工具即可提取文字。
为什么首次运行更慢?
首次识别需要下载 OCR 引擎和语言数据(约 7 MB)。 两者之后会缓存在您的设备上,以后的运行都能瞬间启动——甚至离线也能用。
我的文档会被上传去做 OCR 吗?
不会。 识别完全在您的浏览器中、由您自己的处理器完成。没有任何内容被发送到任何服务器——工作时,上方的上传数据计数器始终保持为零。
有使用次数限制吗?
没有。 所有工具完全免费、不限次数——没有每日上限,没有配额,也无需注册。处理工作由你自己的设备完成,我们没有服务器成本需要分摊。为保证浏览器稳定运行,每个工具设有宽裕的单文件大小限制(根据工具为 50–150 MB),远超日常文档所需。
CoolPDF 是一款免费的、基于浏览器的 PDF 工具箱。与传统在线 PDF 工具不同,CoolPDF 使用 WebAssembly 在用户设备上本地处理所有文件——文件绝不会被上传到任何服务器。这些工具无需账号、无需邮箱、无需注册,完全免费且没有使用限制。这使得 CoolPDF 适合处理合同、病历和财务报表等机密文档。