Ảnh sang văn bản (OCR)
Biến ảnh chụp, ảnh màn hình hoặc trang scan thành văn bản có thể chỉnh sửa. Công cụ Tesseract OCR chạy ngay trong trình duyệt nên ảnh không bao giờ được tải lên. Tiếng Việt, tiếng Anh và 10 ngôn ngữ khác.
Tệp của bạn không bao giờ rời khỏi trình duyệt
Cách sử dụng
- 1
Chọn ngôn ngữ của văn bản trong ảnh.
- 2
Thả ảnh JPG, PNG hoặc WebP — nhận dạng bắt đầu tự động.
- 3
Sao chép văn bản hoặc tải về dạng .txt.
Câu hỏi thường gặp
Ảnh của tôi có bị tải lên không?
Không. OCR chạy cục bộ với Tesseract biên dịch sang WebAssembly. Dữ liệu ngôn ngữ (2–3 MB) được tải một lần và lưu đệm.
Độ chính xác thế nào?
Rất tốt với chữ in rõ, nằm ngang và ảnh chụp màn hình. Chữ viết tay, độ phân giải thấp hoặc ảnh nghiêng làm giảm độ chính xác — hãy cắt và chỉnh thẳng ảnh trước.
Hỗ trợ những ngôn ngữ nào?
Tiếng Việt, Anh, Nga, Ukraina, Ba Lan, Thổ Nhĩ Kỳ, Tây Ban Nha, Bồ Đào Nha, Indonesia, Đức, Pháp và Ý.
Có trích xuất văn bản từ PDF được không?
Với PDF có chữ thật, dùng PDF sang văn bản. Với PDF scan, chuyển một trang bằng PDF sang JPG rồi đưa vào công cụ này.
Vì sao lần chạy đầu chậm?
Công cụ và gói ngôn ngữ được tải khi dùng lần đầu. Các lần sau chỉ mất vài giây mỗi ảnh.