Việc trích xuất văn bản sử dụng nhận diện văn bản trên trang PDF được chọn. Khi nhận diện thành công, diScanner sẽ sao chép kết quả vào bộ nhớ tạm hệ thống và hiển thị Copied — Text has been copied to the clipboard. Độ chính xác phụ thuộc vào tiêu cự, độ tương phản, ngôn ngữ, bố cục và chữ viết tay.
Các bước
- Mở file PDF từ Documents.
- Chạm vào trang mà bạn cần trích xuất văn bản.
- Chạm vào nút text viewfinder màu xanh lá hiển thị trên trang được chọn.
- Chờ cho đến khi hiển thị Copied hoặc No Text Extracted.
- Sau khi nhận diện thành công, dán văn bản vào Notes hoặc nơi bạn muốn sử dụng.
- So sánh tên, số tiền, ngày tháng và số tham chiếu với trang gốc trước khi tin tưởng hoàn toàn vào chúng.
Trước khi kết thúc
- Nhận diện có thể nhầm lẫn các ký tự tương tự, cột, phông chữ trang trí và chữ in mờ.
- Việc trích xuất văn bản không làm thay đổi trang PDF.
- Nội dung bộ nhớ tạm có thể được truy cập bởi các ứng dụng bạn dán vào, vì vậy tránh để văn bản nhạy cảm trong bộ nhớ tạm lâu hơn mức cần thiết.
- Nút tài liệu văn bản trên thanh công cụ trên cùng là một hành động khác: nó chuẩn bị văn bản đã nhận diện từ toàn bộ PDF dưới dạng file văn bản có thể chia sẻ.
Mẹo
- Để có kết quả tốt hơn, hãy xoay trang về đúng chiều trước.
- Xem văn bản trích xuất như một bản nháp cần được đọc lại.
- Nếu diScanner báo No Text Extracted, hãy quét lại trang với tiêu cự tốt hơn, căn thẳng hơn và độ tương phản mạnh hơn.