tooly

Cách trích xuất văn bản từ ảnh chụp màn hình hoặc ảnh chụp

Ai đó gửi cho bạn ảnh chụp một địa chỉ, một thông báo lỗi, một công thức nấu ăn; một trang sách bạn muốn trích dẫn; một hóa đơn cần đưa vào báo cáo chi tiêu. Gõ lại thủ công là cách chậm nhất. OCR — nhận dạng ký tự quang học — biến các điểm ảnh trở lại thành văn bản.

Các bước thực hiện

  1. Mở Ảnh sang văn bản và chọn ngôn ngữ của văn bản. Văn bản trộn lẫn với từ tiếng Anh được xử lý tự động.
  2. Thả ảnh chụp màn hình hoặc ảnh chụp vào. Quá trình nhận dạng tự khởi động.
  3. Sao chép văn bản hoặc tải về dưới dạng file .txt.

Để có kết quả chính xác

  • Cắt sát phần văn bản. Thanh công cụ, hình nền hay bàn tay lọt vào ảnh sẽ khiến công cụ nhận dạng nhầm lẫn. Dùng Cắt ảnh trước nếu ảnh chụp màn hình có nhiều chi tiết thừa.
  • Chỉnh thẳng ảnh chụp. OCR mong đợi các dòng chữ nằm ngang; một trang được chụp lệch góc sẽ mất khá nhiều độ chính xác.
  • Độ phân giải rất quan trọng. Chữ nên cao ít nhất 20–30 điểm ảnh. Hãy zoom trước khi chụp màn hình thay vì phóng to sau đó.
  • Ảnh chụp màn hình cho kết quả tốt hơn ảnh chụp thường. Chữ hiển thị trên màn hình sắc nét và đều sáng, trong khi ảnh chụp thực tế hiếm khi được như vậy.

Với file PDF

Một file PDF được xuất từ Word đã sẵn có văn bản bên trong — hãy dùng Trích xuất văn bản từ PDF, cho kết quả tức thì và chính xác. Một file PDF dạng scan thực chất chỉ là hình ảnh: xuất một trang bằng PDF sang JPG rồi đưa qua Ảnh sang văn bản.

Còn chữ viết tay thì sao?

Engine nhận dạng (Tesseract) được thiết kế cho văn bản in. Chữ in hoa gọn gàng đôi khi vẫn nhận được; chữ viết tay nối liền thì không. Với chữ viết tay, tính năng nhận diện văn bản tích hợp sẵn trong camera điện thoại hiện vẫn là lựa chọn tốt hơn.

Đăng ngày 2026-09-21