一般的な画像
JPG、PNG、WebP、HEIC、BMP、TIFF(Safari)、および任意のデバイスからのスクリーンショット。
Most "image to text" tools online want you to upload a photo of an ID, a receipt, or a screenshot to a server you've never heard of. Google Vision OCR is excellent but bills per call and ships your image through their API. Morph runs Tesseract — the open-source OCR standard — directly in your browser via WebAssembly. The image, the language model, and the extracted text all stay on your device. Drop a JPG, PNG, WebP, HEIC, BMP, or scan; copy the text or save as TXT or DOCX. Free for everything that runs on your device; AI is paid in credits.
Googleが新しいモデルをトレーニングする前に10年以上運用していた同じエンジンです。クリーンな印刷テキストに対して成熟し、正確で、無料です。APIキーもページごとの料金も必要ありません。アップロードもありません。
英語デフォルト;追加の言語パックは必要に応じてダウンロードし、最初の実行後にローカルにキャッシュされます。
JPG、PNG、WebP、HEIC、BMP、TIFF(Safari)、および任意のデバイスからのスクリーンショット。
クリップボードにコピーするか、プレーンテキストまたはWordドキュメントとして保存します。
領収書、身分証明書、医療書類、契約書は、OCRが必要とされる文書の代表例であり、また、第三者のサーバーに保存しないで済む文書でもあります。ほとんどのオンラインOCRツールは画像をAPI経由で送信し、不正防止のためログを記録した上で、エクスポート時に透かしを削除する有料プランを提供しています。Morphはブラウザ内でTesseractを直接実行するため、APIを呼び出す必要も、不正防止のログ記録も、アップロードも一切ありません。
手書き(特に草書体)、低コントラストの写真、魚眼歪曲、混合カラムが密集したレイアウトの場合、Google VisionやAzure OCRは最新のMLモデルにより測定可能な精度の優位性があります。月に数万ページを処理し、精度がプライバシーよりも重要である場合は、これらのサービスはコストを支払う価値があります。ほとんどの日常的なOCR(領収書、スクリーンショット、スキャンした印刷物、明るい光で撮影されたテキストの写真)については、ローカルで実行されるTesseractで十分で、ドキュメントをどこにも送信しません。
いいえ。TesseractはWebAssemblyでブラウザタブ内に実行されます。画像と抽出されたテキストの両方がデバイスに残ります。
100+ languages including English, Spanish, French, German, Portuguese, Italian, Dutch, Arabic, Chinese (simplified + traditional), Japanese, Korean, Hindi, Russian. Additional packs download on demand and cache for next time.
Tesseract はオープンソースの OCR 標準です。きれいな印刷テキストの精度は 95%+ です。手書きや低コントラストの写真はかなり難しくなります — まずコントラストの前処理を検討してください。
はい。マルチページTIFFまたは画像のスタックをドロップし、出力でページ区切りを保持します。
PDFツールを最初に使用してページを画像として抽出し、その後OCRで処理します。または、OCRツールの組み込みPDFページサポートを使用します。