Будь-яке поширене зображення
JPG, PNG, WebP, HEIC, BMP, TIFF (Safari), та знімків екрану з будь-якого пристрою.
Most "image to text" tools online want you to upload a photo of an ID, a receipt, or a screenshot to a server you've never heard of. Google Vision OCR is excellent but bills per call and ships your image through their API. Morph runs Tesseract — the open-source OCR standard — directly in your browser via WebAssembly. The image, the language model, and the extracted text all stay on your device. Drop a JPG, PNG, WebP, HEIC, BMP, or scan; copy the text or save as TXT or DOCX. Free for everything that runs on your device; AI is paid in credits.
Той самий двигун, який Google використовував більше десяти років, перш ніж навчити свої нові моделі. Зрілий, точний на чистому друкованому тексті, і безкоштовний. Немає API-ключа, немає плати за сторінку, немає завантаження.
Англійська за замовчуванням; завантажте додаткові пакети мов за потреби — зберігаються локально після першого запуску.
JPG, PNG, WebP, HEIC, BMP, TIFF (Safari), та знімків екрану з будь-якого пристрою.
Скопіюйте у буфер або збережіть як звичайний текст або документ Word.
Рахунки, посвідчення, медичні форми та договори — саме такі документи люди найбільше потребують OCR для — і вони ж є документами, які найбільше варто тримати віддаленими від третьої сторони. Більшість онлайн-інструментів OCR надсилають ваше зображення через їхній API, логують його для «попередження зловживань» та потім пропонують платний рівень, щоб прибрати водяний знак з експорту. Morph працює з Tesseract безпосередньо в вашому браузері; немає API для виклику, немає логування для попередження зловживань, ніякого завантаження.
Для рукописного тексту (особливо курсиву), фото з низькою контрастністю, риб’ячого ока, густих розміщень зі змішаними стовпцями Google Vision та Azure OCR мають помітну перевагу у точності завдяки новішим моделям ML. Якщо ви обробляєте десятки тисяч сторінок на місяць і точність важливіша за конфіденційність, ці послуги варті своєї вартості. Для більшості повсякденних завдань OCR — чеків, скріншотів, сканованих друкованих текстів, фотографій тексту в чистому світлі — Tesseract, що працює локально, достатньо, і він не надсилає ваш документ нікому.
Ні. Tesseract працює у WebAssembly у вашій вкладці браузера. Зображення та витягнутий текст залишаються на вашому пристрої.
100+ мов, включаючи англійську, іспанську, французьку, німецьку, португальську, італійську, голландську, арабську, китайську (спрощена + традиційна), японську, корейську, хінді, російську. Додаткові пакети завантажуються за потреби та кешуються для наступного разу.
Tesseract — це відкритий стандарт OCR. Точність на чистому друкованому тексті становить 95%+. Письмо власноруч і низькоконтрастні фотографії значно важче розпізнати — спочатку розгляньте передпроцесор контрасту.
Так. Перетягніть багатосторінковий TIFF або стос картинок, і вихідний файл зберігатиме розриви сторінок.
Спочатку скористайтеся інструментами PDF, щоб витягти сторінки у вигляді зображень, а потім застосуйте OCR. Або використовуйте вбудовану підтримку PDF-сторінок у інструменті OCR.