Chuyển ảnh thành văn bản (OCR online miễn phí)
xFormat.space lấy chữ từ ảnh bằng mô hình nhận dạng chạy ngay trong trình duyệt, hỗ trợ tiếng Anh, tiếng Trung, tiếng Nhật, tiếng Hàn, tiếng Pháp và tiếng Đức mà không tải ảnh của bạn lên.
Chạy trên trình duyệt – file không rời khỏi thiết bị.
Cách sử dụng
Biến ảnh chụp màn hình, ảnh chụp trang sách hay hóa đơn đã scan thành văn bản có thể sao chép và chỉnh sửa. Mô hình nhận dạng chạy trên thiết bị của bạn, nên bản thân ảnh không bao giờ bị tải lên. Lần chạy đầu tải một mô hình khoảng 15 MB, được lưu lại cho các lần sau.
- 1
Thả ảnh (JPG, PNG hoặc WebP) vào trang và mở OCR.
- 2
Chọn ngôn ngữ nhận dạng khớp với chữ trong ảnh.
- 3
Bấm Bắt đầu nhận dạng, rồi sửa, sao chép văn bản hoặc tải về dạng file TXT.
Ngôn ngữ và cách chọn
Có sáu lựa chọn, mỗi lần chọn một: Tiếng Trung & tiếng Anh, Tiếng Anh, Tiếng Nhật, Tiếng Hàn, Tiếng Pháp và Tiếng Đức. Lựa chọn Tiếng Trung & tiếng Anh đọc được tiếng Trung (giản thể và phồn thể) cùng tiếng Anh, nên dùng cho văn bản trộn lẫn. Với tài liệu thuần tiếng Anh, chọn Tiếng Anh là hợp lý nhất. Đổi ngôn ngữ sẽ tải một mô hình khác ở lần đầu dùng. Tiếng Việt hiện không nằm trong danh sách này.
Để kết quả chính xác hơn
Độ chính xác của OCR chủ yếu phụ thuộc vào ảnh đầu vào. Hãy dùng ảnh chụp màn hình gốc thay vì bản đã bị nén khi gửi qua ứng dụng chat như Zalo hay Messenger. Khi chụp giấy tờ, chụp thẳng, ánh sáng đều, chữ chiếm phần lớn khung hình và không có bóng đổ ngang dòng chữ. Cắt bỏ nền rối trước và tránh bị lóa. Chữ in cho kết quả tốt nhất; chữ viết tay và phông chữ trang trí thì lúc được lúc không.
Sau khi nhận dạng, bạn sẽ thấy số vùng chữ tìm được và điểm tin cậy trung bình. Hãy coi đó là gợi ý chứ không phải đảm bảo, và soát lại số liệu, tên riêng cùng mọi thứ liên quan đến pháp lý hay tài chính. Ô văn bản cho phép sửa, nên bạn có thể chữa lỗi trước khi sao chép. Lần tải mô hình đầu tiên cần kết nối Internet; ảnh của bạn vẫn ở trên thiết bị.
Câu hỏi thường gặp
Làm sao lấy chữ từ ảnh?
Trên xFormat.space, thả ảnh vào trang, chọn ngôn ngữ và bấm Bắt đầu nhận dạng. Văn bản nhận dạng hiện trong một ô có thể sửa, bạn sao chép hoặc tải về dạng TXT.
OCR hỗ trợ những ngôn ngữ nào?
Tiếng Trung & tiếng Anh (đọc được cả tiếng Trung phồn thể), tiếng Anh, tiếng Nhật, tiếng Hàn, tiếng Pháp và tiếng Đức. Mỗi lần chạy bạn chọn một ngôn ngữ.
Có nhận dạng được chữ tiếng Việt không?
Hiện chưa. Tiếng Việt không nằm trong sáu lựa chọn của xFormat.space (Tiếng Trung & tiếng Anh, Tiếng Anh, Tiếng Nhật, Tiếng Hàn, Tiếng Pháp, Tiếng Đức), nên kết quả với chữ tiếng Việt có dấu sẽ không đáng tin cậy.
Ảnh có bị tải lên máy chủ để OCR không?
Không. Mô hình nhận dạng chạy trong trình duyệt. Chỉ các file mô hình được tải về, khoảng 15 MB ở lần đầu, còn ảnh của bạn ở lại trên thiết bị.
Vì sao lần OCR đầu tiên chậm hơn?
Lần đầu phải tải mô hình nhận dạng chữ và bộ máy chạy nó. Sau đó chúng được lưu lại, nên các lần sau khởi động nhanh hơn nhiều.
Có đọc được chữ viết tay không?
Công cụ được xây dựng cho chữ in. Chữ viết tay gọn gàng có thể nhận được một phần, nhưng kết quả không đáng tin cậy, nên hãy luôn kiểm tra lại.