ToolHub
Mở công cụ

Trích xuất văn bản từ ảnh

Trích xuất văn bản từ ảnh (OCR)

Công cụ hình ảnh

Về công cụ này

Công cụ trích xuất văn bản từ ảnh dựa trên engine Tesseract.js thực hiện nhận dạng văn bản OCR, hỗ trợ kéo thả hoặc nhấp tải lên ảnh và hiển thị tiến độ nhận dạng thời gian thực. Kết quả nhận dạng hỗ trợ sao chép một cú nhấp, thuận tiện nhanh chóng lấy nội dung văn bản trong ảnh. Tất cả thao tác đều hoàn thành cục bộ trong trình duyệt

Tính năng chính

Xem nhanh

Tình huống sử dụng

image text

Câu hỏi thường gặp

Độ chính xác nhận dạng OCR thế nào?

Độ chính xác nhận dạng phụ thuộc vào chất lượng ảnh và độ rõ của văn bản. Ảnh rõ nét, độ tương phản cao có độ chính xác cao hơn, văn bản mờ hoặc viết tay hiệu quả nhận dạng có thể kém. Khuyên sử dụng ảnh chụp màn hình hoặc bản scan rõ nét.

Hỗ trợ nhận dạng văn bản những ngôn ngữ nào?

Dựa trên engine Tesseract.js, hỗ trợ hơn 100 ngôn ngữ như Tiếng Trung, Tiếng Anh, Tiếng Nhật, Tiếng Hàn, v.v. Lần đầu sử dụng ngôn ngữ nào cần tải gói ngôn ngữ tương ứng, có thể mất vài giây.

Làm thế nào nếu tốc độ nhận dạng chậm?

Xử lý OCR diễn ra cục bộ trong trình duyệt, tốc độ phụ thuộc vào kích thước ảnh và hiệu suất thiết bị. Khuyên sử dụng ảnh kích thước nhỏ hơn và đảm bảo kết nối mạng bình thường để tải gói ngôn ngữ.

Hỗ trợ những định dạng hình ảnh nào?

Hỗ trợ các định dạng ảnh phổ biến như PNG, JPG, WebP, BMP. Khuyên sử dụng ảnh độ phân giải cao, độ rõ tốt để có hiệu quả nhận dạng tốt nhất.

Dữ liệu ảnh có được tải lên máy chủ không?

Không. Tất cả xử lý OCR đều hoàn thành cục bộ trong trình duyệt qua Tesseract.js, dữ liệu ảnh không rời khỏi thiết bị của bạn, hoàn toàn bảo vệ quyền riêng tư.