Hình ảnh thông thường bất kỳ
JPG, PNG, WebP, HEIC, BMP, TIFF (Safari), và ảnh chụp màn hình từ bất kỳ thiết bị nào.
Most "image to text" tools online want you to upload a photo of an ID, a receipt, or a screenshot to a server you've never heard of. Google Vision OCR is excellent but bills per call and ships your image through their API. Morph runs Tesseract — the open-source OCR standard — directly in your browser via WebAssembly. The image, the language model, and the extracted text all stay on your device. Drop a JPG, PNG, WebP, HEIC, BMP, or scan; copy the text or save as TXT or DOCX. Free for everything that runs on your device; AI is paid in credits.
Cùng một động cơ Google đã chạy trong hơn một thập kỷ trước khi họ huấn luyện mô hình mới. Chín chắn, chính xác với văn bản in sạch, và miễn phí. Không cần khóa API, không phí mỗi trang, không tải lên.
Tiếng Anh mặc định; tải thêm gói ngôn ngữ theo yêu cầu — được lưu cục bộ sau lần chạy đầu tiên.
JPG, PNG, WebP, HEIC, BMP, TIFF (Safari), và ảnh chụp màn hình từ bất kỳ thiết bị nào.
Sao chép vào clipboard hoặc lưu dưới dạng văn bản thuần túy hoặc tài liệu Word.
Hóa đơn, thẻ ID, giấy tờ y tế và hợp đồng là những loại tài liệu mà mọi người cần OCR nhiều nhất — và cũng là những tài liệu đáng giá nhất để giữ an toàn trên máy chủ thứ ba. Hầu hết công cụ OCR trực tuyến gửi hình ảnh của bạn qua API của họ, lưu trữ để ngăn chặn "lạm dụng", sau đó cung cấp gói trả phí để loại bỏ watermark khỏi tệp xuất. Morph chạy Tesseract trực tiếp trong trình duyệt; không có API nào được gọi, không có lưu trữ ngăn chặn lạm dụng, không tải lên.
Đối với chữ viết tay (đặc biệt là chữ viết cẩn thận), ảnh có độ tương phản thấp, biến dạng hình cá, và bố cục dày đặc với nhiều cột, Google Vision và Azure OCR có độ chính xác vượt trội nhờ mô hình ML mới hơn. Nếu bạn xử lý hàng chục nghìn trang mỗi tháng và độ chính xác quan trọng hơn quyền riêng tư, các dịch vụ này xứng đáng với chi phí. Đối với hầu hết trường hợp OCR hàng ngày — hóa đơn, ảnh chụp màn hình, bản sao in, ảnh chụp văn bản dưới ánh sáng rõ ràng — Tesseract chạy cục bộ là đủ, và nó không gửi tài liệu của bạn đi đâu cả.
Không. Tesseract chạy trong WebAssembly bên trong tab trình duyệt của bạn. Hình ảnh và văn bản trích xuất đều ở trên thiết bị của bạn.
Hơn 100 ngôn ngữ bao gồm tiếng Anh, Tây Ban Nha, Pháp, Đức, Bồ Đào Nha, Ý, Hà Lan, Ả Rập, Trung Quốc (phồn thể + giản thể), Nhật, Hàn, Hindi, Nga. Các gói bổ sung tải xuống khi cần và được lưu trữ tạm để sử dụng lần sau.
Tesseract là tiêu chuẩn OCR mã nguồn mở. Độ chính xác với văn bản in sạch là 95%+. Chữ viết tay và ảnh có độ tương phản thấp khó xử lý hơn đáng kể — hãy xem xét sử dụng bộ tiền xử lý tương phản trước.
Vâng. Thả một tệp TIFF đa trang hoặc một chồng ảnh và đầu ra sẽ giữ nguyên các ngắt trang.
Sử dụng công cụ PDF trước tiên để trích xuất trang dưới dạng hình ảnh, sau đó chạy chúng qua OCR. Hoặc sử dụng hỗ trợ trang PDF tích hợp trong công cụ OCR.