开始前
- 使用最清晰的扫描件,并在上传前旋转正页面。
- 选择与主要文字一致的文档语言。
PDF OCR 工具
将扫描版 PDF 转换为可搜索、可复制文字的 PDF,并下载识别出的 TXT 文本。
当需要保留 PDF 形态、同时让用户能搜索和选中文本时使用此工具;需要编辑文档时应选择转 Word。
PDF 和结果会在服务器临时处理。默认 30 分钟清理,处理超时为五分钟。
大多数服务器文件工具的默认保留期为 30 分钟。过期文件会由定时任务清理,因此这不是精确的删除时间点。
扫描件 OCR 前如何提升识别准确度注意限制: 手写体、低对比度、倾斜、装饰字体和混合语言都会降低识别准确度。
将扫描 PDF 转成可搜索 PDF,并下载识别出的文字。
上传扫描 PDF 并选择语言后,OCRmyPDF 会添加可搜索的文字层。你可以下载可搜索 PDF 和 TXT 识别结果。
这个工具需要服务器端处理。上传的文件、提交的 URL 或生成的结果只会临时保存,并会按保留策略自动清理。
是的,当前工具可以直接在线使用。
这个工具需要服务器端处理。上传的文件、提交的 URL 或生成的结果只会临时保存,并会按保留策略自动清理。
不建议。服务器端和临时服务类工具更适合测试、转换和临时工作流。