Đi tới nội dung

Nhận dạng chữ tiếng Việt từ bản scan (OCR)

OCR đọc chữ trong ảnh và bản scan. Bộ nhận dạng tiếng Việt chạy ngay trên máy bạn; tệp không được gửi đi.

3 phút4 bước

Các bước

  1. Chọn bản scan hoặc ảnhMở OCR văn bản, chọn tệp PDF scan hoặc ảnh JPG, PNG. Chọn được nhiều tệp và đổi thứ tự.
  2. Chọn kiểu kết quả“PDF tìm được chữ” giữ nguyên hình trang và thêm lớp chữ để tìm (Ctrl+F), sao chép. “Văn bản (.txt)” chỉ lấy phần chữ.
  3. Bấm “Nhận dạng chữ”Lần đầu, công cụ tải bộ nhận dạng tiếng Việt (khoảng 1,4 MB) từ chính trang này. Sau đó mỗi trang mất vài giây.
  4. Tải hoặc sao chépBản PDF tải về có tên “<tên tệp> - OCR.pdf”. Bản văn bản hiện trong khung “Nội dung văn bản”; bấm “Sao chép” để dán sang nơi khác.

Mẹo

  • Ảnh chụp thẳng, rõ nét, chữ đủ lớn cho kết quả tốt nhất.
  • Trang đã có sẵn lớp chữ được bỏ qua, không đọc lại.
  • Chỉ cần lấy chữ từ một tấm ảnh: dùng Ảnh → Văn bản, nhanh hơn.

Cần lưu ý

  • Hiện chỉ nhận dạng tiếng Việt.
  • OCR có thể đọc sai, nhất là ảnh mờ hoặc chữ viết tay. Hãy soát lại trước khi dùng.
  • Lần đầu cần có mạng để tải bộ nhận dạng.