Các bước
- Chọn bản scan hoặc ảnhMở OCR văn bản, chọn tệp PDF scan hoặc ảnh JPG, PNG. Chọn được nhiều tệp và đổi thứ tự.
- Chọn kiểu kết quả“PDF tìm được chữ” giữ nguyên hình trang và thêm lớp chữ để tìm (Ctrl+F), sao chép. “Văn bản (.txt)” chỉ lấy phần chữ.
- Bấm “Nhận dạng chữ”Lần đầu, công cụ tải bộ nhận dạng tiếng Việt (khoảng 1,4 MB) từ chính trang này. Sau đó mỗi trang mất vài giây.
- Tải hoặc sao chépBản PDF tải về có tên “<tên tệp> - OCR.pdf”. Bản văn bản hiện trong khung “Nội dung văn bản”; bấm “Sao chép” để dán sang nơi khác.
Mẹo
- Ảnh chụp thẳng, rõ nét, chữ đủ lớn cho kết quả tốt nhất.
- Trang đã có sẵn lớp chữ được bỏ qua, không đọc lại.
- Chỉ cần lấy chữ từ một tấm ảnh: dùng Ảnh → Văn bản, nhanh hơn.
Cần lưu ý
- Hiện chỉ nhận dạng tiếng Việt.
- OCR có thể đọc sai, nhất là ảnh mờ hoặc chữ viết tay. Hãy soát lại trước khi dùng.
- Lần đầu cần có mạng để tải bộ nhận dạng.