Любое распространенное изображение
JPG, PNG, WebP, HEIC, BMP, TIFF (Safari), и скриншоты с любого устройства.
Most "image to text" tools online want you to upload a photo of an ID, a receipt, or a screenshot to a server you've never heard of. Google Vision OCR is excellent but bills per call and ships your image through their API. Morph runs Tesseract — the open-source OCR standard — directly in your browser via WebAssembly. The image, the language model, and the extracted text all stay on your device. Drop a JPG, PNG, WebP, HEIC, BMP, or scan; copy the text or save as TXT or DOCX. Free for everything that runs on your device; AI is paid in credits.
Та же самая引擎, которую Google использовал более десяти лет до того, как они обучили свои новые модели. Зрелая, точная на чистом печатном тексте и бесплатная. Нет API-ключа, нет оплаты за страницу, нет загрузки.
Английский по умолчанию; загрузите дополнительные языковые пакеты по требованию — кэшируются локально после первого запуска.
JPG, PNG, WebP, HEIC, BMP, TIFF (Safari), и скриншоты с любого устройства.
Копировать в буфер обмена или сохранить как обычный текст или документ Word.
Чеки, удостоверения личности, медицинские формы и контракты — именно те документы, для которых чаще всего нужен OCR, и именно те документы, которые стоит хранить вне сторонних серверов. Большинство онлайн-инструментов OCR отправляют вашу картинку через их API, логируют её для «предотвращения злоупотреблений» и затем предлагают платную подписку, чтобы убрать водяной знак с экспорта. Morph работает с Tesseract прямо в браузере; нет API для вызова, нет логирования предотвращения злоупотреблений, никакой загрузки.
Для рукописного текста (особенно курсивного), фото с низкой контрастностью, искажений в виде «рыбьего глаза» и плотных макетов с разными колонками Google Vision и Azure OCR имеют заметное преимущество в точности благодаря более новым моделям машинного обучения. Если вы обрабатываете десятки тысяч страниц в месяц и точность важнее приватности, эти сервисы стоят своих денег. Для повседневного использования OCR — чеков, скриншотов, отсканированных текстов, фотографий текста в хорошем свете — локально запущенный Tesseract достаточно, и он не отправляет ваш документ никуда.
Нет. Tesseract работает в WebAssembly внутри вашей вкладки браузера. Изображение и извлеченный текст остаются на вашем устройстве.
Более 100 языков, включая английский, испанский, французский, немецкий, португальский, итальянский, голландский, арабский, китайский (упрощенный + традиционный), японский, корейский, хинди, русский. Дополнительные пакеты загружаются по требованию и кэшируются для следующего раза.
Tesseract — это открытый стандарт OCR. Точность при обработке чистого печатного текста составляет 95%+. Распознавание рукописного текста и низкоконтрастных фотографий значительно сложнее — сначала рассмотрите использование предварительного процессора контраста.
Да. Перетащите многостраницовый TIFF или стопку изображений, и выходной файл сохранит разбивку на страницы.
Сначала используйте инструменты PDF для извлечения страниц в виде изображений, затем примените их к OCR. Или используйте встроенную поддержку PDF-страниц в инструменте OCR.