diScanner 提供两种文本识别工作流程:

  • 选中页面上的绿色 文本取景器 按钮可将该页面的文本复制到剪贴板。
  • 顶部工具栏中的 文本文档 按钮会处理完整的 PDF,并准备一个 .txt 文件以供分享。

当您需要将多页扫描的文本合并到一个文件时,请使用完整文档选项。

导出所有识别的文本

  1. 文档 中打开 PDF。
  2. 检查页面顺序。文本文件将按照 PDF 当前的顺序排列。
  3. 在开始识别前,旋转任何横向页面。
  4. 点击右上角工具栏中的 文本文档 按钮。
  5. 等待 diScanner 处理文档。
  6. 从 iOS 分享表单中选择目标位置,例如 保存到文件、邮件、信息或兼容的文本应用。
  7. 打开导出的 .txt 文件,并与扫描页面对照校对。

导出文件名基于 PDF 文件名。导出前重命名文档可使文本文件更易识别。

文本识别能保留和不能保留的内容

文本文件包含识别出的字符,而非 PDF 的视觉副本。它可能无法保留:

  • 列和复杂的阅读顺序。
  • 表格、表单字段和复选框。
  • 字体样式、页面背景、印章或签名。
  • 精确的换行和间距。
  • 手写或装饰性字体的准确性。

姓名、日期、价格、账号等相似字符需特别注意。例如,识别可能会混淆 0O1I,或将标点误识为扫描图像中的符号。

导出前提升识别效果

  • 确保每页均为正向。
  • 重新扫描模糊、有阴影或严重裁剪的页面。
  • 保持文字与纸张的高对比度。
  • 保持预期的页面顺序。
  • 删除不应包含在文本输出中的页面。

文本识别不能替代扫描的 PDF。当布局、签名、图像或精确视觉记录重要时,请保留 PDF。

隐私注意事项

导出的文本成为单独的文件。交给 iOS 分享表单后,存储和传输由您选择的目标处理。

在分享敏感文本前:

  1. 确认目标应用和接收人。
  2. 检查文件名是否泄露隐私信息。
  3. 校对导出内容。
  4. 不再需要时,从文件、邮件草稿或其他位置删除临时副本。

复制单页到剪贴板和导出完整文本文件是不同的复制方式。清空剪贴板不会删除导出的 .txt 文件,删除文本文件也不会移除原始 PDF。