diScanner 提供两种文本识别工作流程:
- 选中页面上的绿色 文本取景器 按钮可将该页面的文本复制到剪贴板。
- 顶部工具栏中的 文本文档 按钮会处理完整的 PDF,并准备一个
.txt文件以供分享。
当您需要将多页扫描的文本合并到一个文件时,请使用完整文档选项。
导出所有识别的文本
- 从 文档 中打开 PDF。
- 检查页面顺序。文本文件将按照 PDF 当前的顺序排列。
- 在开始识别前,旋转任何横向页面。
- 点击右上角工具栏中的 文本文档 按钮。
- 等待 diScanner 处理文档。
- 从 iOS 分享表单中选择目标位置,例如 保存到文件、邮件、信息或兼容的文本应用。
- 打开导出的
.txt文件,并与扫描页面对照校对。
导出文件名基于 PDF 文件名。导出前重命名文档可使文本文件更易识别。
文本识别能保留和不能保留的内容
文本文件包含识别出的字符,而非 PDF 的视觉副本。它可能无法保留:
- 列和复杂的阅读顺序。
- 表格、表单字段和复选框。
- 字体样式、页面背景、印章或签名。
- 精确的换行和间距。
- 手写或装饰性字体的准确性。
姓名、日期、价格、账号等相似字符需特别注意。例如,识别可能会混淆 0 和 O,1 和 I,或将标点误识为扫描图像中的符号。
导出前提升识别效果
- 确保每页均为正向。
- 重新扫描模糊、有阴影或严重裁剪的页面。
- 保持文字与纸张的高对比度。
- 保持预期的页面顺序。
- 删除不应包含在文本输出中的页面。
文本识别不能替代扫描的 PDF。当布局、签名、图像或精确视觉记录重要时,请保留 PDF。
隐私注意事项
导出的文本成为单独的文件。交给 iOS 分享表单后,存储和传输由您选择的目标处理。
在分享敏感文本前:
- 确认目标应用和接收人。
- 检查文件名是否泄露隐私信息。
- 校对导出内容。
- 不再需要时,从文件、邮件草稿或其他位置删除临时副本。
复制单页到剪贴板和导出完整文本文件是不同的复制方式。清空剪贴板不会删除导出的 .txt 文件,删除文本文件也不会移除原始 PDF。