PDF OCR 在线文字识别——将扫描 PDF 转为可搜索文档
通过自托管服务在线识别 PDF 文字,支持英文、简体中文和繁体中文,为扫描 PDF 添加可搜索文本层。
支持格式: PDF
文件只会发送到您的自托管 PDF 处理服务,并在处理后从应用临时存储中删除。
关于此工具
此 PDF OCR 在线工具可以识别扫描页面中的文字,并为 PDF 添加可搜索文本层。可选择英文、简体中文或繁体中文,设置已有文字页面的处理方式,并启用扫描页倾斜校正。
使用方法
- 选择扫描版或图片型 PDF。
- 选择文档语言、OCR 模式以及是否校正倾斜页面。
- 开始识别、下载结果,并在多个页面测试搜索和文字选择。
功能特点
- 支持英文、简体中文和繁体中文识别。
- 提供跳过已有文字、强制全部识别和保留已有文字模式。
- 识别前可自动校正扫描页面倾斜。
常见使用场景
- 让扫描合同或报告可以搜索。
- 为纸质文档归档添加可选择文字。
- 为文档检索或后续文字提取准备扫描件。
常见问题与提示
- 分辨率低、模糊、手写内容和复杂排版会降低识别准确率。
- 选择错误语言可能生成不正确的文字。
隐私
所选 PDF 会发送到 Tools12345 自托管 OCR 服务处理,不会作为用户文件永久保存。
常见问题
OCR 会改变 PDF 页面外观吗?
处理目标是在保留页面外观的同时添加识别文字,但倾斜校正和 OCR 处理可能改变部分页面渲染细节。
应该选择哪种 OCR 语言?
请选择文档中主要使用的语言:英文、简体中文或繁体中文。
OCR 能准确识别手写文字吗?
不能保证。手写内容、低质量扫描、特殊字体和多栏排版都需要人工仔细检查。