ja

画像からテキスト (OCR)

写真やスキャンからテキストを抽出 - ブラウザ内でOCR処理、アップロード不要。

お使いの端末でローカル処理中 ...

ドキュメントの言語
  • Deutsch
  • English
  • Français
  • Español
  • Italiano
  • Português
  • Nederlands
  • Polski
  • Русский
  • Українська
  • Čeština
  • Slovenčina
  • Română
  • Magyar
  • Ελληνικά
  • Türkçe
  • Svenska
  • Dansk
  • Norsk
  • Suomi
  • Català
  • Hrvatski
  • Српски
  • Български
  • العربية
  • עברית
  • فارسی
  • اردو
  • हिन्दी
  • বাংলা
  • 日本語
  • 한국어
  • 简体中文
  • 繁體中文
  • ไทย
  • Tiếng Việt
  • Bahasa Indonesia
  • Bahasa Melayu
  • Afrikaans
  • አማርኛ
  • অসমীয়া
  • Azərbaycanca
  • Азәрбајҹанҹа (Кирил)
  • Беларуская
  • བོད་སྐད་
  • Bosanski
  • Brezhoneg
  • Cebuano
  • ᏣᎳᎩ
  • Corsu
  • Cymraeg
  • ދިވެހި
  • རྫོང་ཁ
  • Esperanto
  • Eesti
  • Euskara
  • Føroyskt
  • Filipino
  • Frysk
  • Gàidhlig
  • Gaeilge
  • Galego
  • Ἀρχαία Ἑλληνικά
  • ગુજરાતી
  • Kreyòl ayisyen
  • Հայերեն
  • ᐃᓄᒃᑎᑐᑦ
  • Íslenska
  • Basa Jawa
  • ಕನ್ನಡ
  • ქართული
  • Қазақша
  • ខ្មែរ
  • Кыргызча
  • Kurmancî
  • ລາວ
  • Latina
  • Latviešu
  • Lietuvių
  • Lëtzebuergesch
  • മലയാളം
  • मराठी
  • Македонски
  • Malti
  • Монгол
  • Māori
  • မြန်မာ
  • नेपाली
  • Occitan
  • ଓଡ଼ିଆ
  • ਪੰਜਾਬੀ
  • پښتو
  • Runa Simi
  • संस्कृतम्
  • සිංහල
  • Slovenščina
  • سنڌي
  • Shqip
  • Srpski (latinica)
  • Basa Sunda
  • Kiswahili
  • ܠܫܢܐ ܣܘܪܝܝܐ
  • தமிழ்
  • Татарча
  • తెలుగు
  • Тоҷикӣ
  • ትግርኛ
  • Lea faka-Tonga
  • ئۇيغۇرچە
  • Oʻzbekcha
  • Ўзбекча (Кирил)
  • ייִדיש
  • Yorùbá

ファイル

    お使いの端末でローカル処理中 ...

    0%

    私のファイルはアップロードされますか?

    いいえ。すべてブラウザ内で動作します。あなたのファイルが端末から出ることはありません。これが検証できる理由

    アップロード不要100%ローカル処理
    中身は手元のまま第三者のアクセスなし
    Hosted in GermanyGlobal Content Delivery
    第三者による検証済みTLS A+ · ヘッダー A+

    OCR (光学文字認識) は、画像内のテキストを選択・編集できる本物のテキストに変換します。請求書・手紙・書籍のページを撮影またはスキャンするだけで、検索・コピー・加工に使えるTXTファイルとして内容を取り出せます。認識エンジンはオープンソースのTesseractで、他のツールと同様にWebAssemblyとしてブラウザ上で完全動作します。

    ドキュメントの言語をリストから選んでください。ドイツ語・英語・ヨーロッパ言語・ロシア語・アラビア語・ヘブライ語・ヒンディー語から日本語・韓国語・中国語まで、100以上の言語に対応しています。各言語はその言語自身の名称で表示されるので、すぐに見つけられます。正しい言語を選ぶことで、その文字体系の文字・アクセント・特殊記号が正確に認識されます。初回利用時にブラウザが認識エンジンと選択した言語モデルをこのサイトから一度だけ取得します (数MB、同一オリジン、外部サーバーなし)。それ以降はオフラインでも利用できます。複数の画像を一度にドロップすると、それぞれ独立したTXTとして出力されます。

    認識精度は元の画像の品質にほぼ完全に依存します。鮮明で水平かつコントラストの高い印刷文字の画像は非常に高精度で認識されますが、傾いた・ぼやけた・暗い画像は精度が大きく落ちます。印刷文字は安定して認識できますが、手書き文字は対応していません。段組・表・複雑なレイアウトは連続テキストとして出力されます。順序はおおむね正しいですが、視覚的な構造は失われます。数字や固有名詞は特に確認してください。

    技術仕様

    技術仕様
    入力形式JPG, JPEG, PNG, WEBP, BMP
    自動変換GIF, TIFF, ICO, SVG, HEIC, PDF, DOCX, DDS, HDR, PCX, WBMP
    出力形式TXT
    一括処理対応
    処理ブラウザ内でローカル処理 (WebAssembly)
    ファイルのアップロードなし

    3ステップで

    1. 画像またはスキャンをドロップします。
    2. リストからドキュメントの言語を選ぶ (100以上の言語)。
    3. 認識したテキストをTXTとしてダウンロードします。

    制限: JPG, PNG, WebP, BMPの鮮明な画像から印刷テキストをTXTとして認識します。手書きは確実には認識できません。100以上の言語・多様な文字体系 (ラテン文字・キリル文字・ギリシャ文字・アラビア文字・ヘブライ文字・インド系文字・CJKなど) に対応 - ドキュメントに合った言語を選んでください。段組・表・レイアウト構造は保持されず、連続テキストとして出力されます。認識は完全ではないため、特に数字や固有名詞を確認してください。初回利用時にエンジンと言語モデルを一度取得します (数MB、同一オリジン)。その後はオフライン対応。スキャンPDFには専用の「PDF OCR」ツール (検索可能PDF・テキストのみ) をご利用ください。

    よくある質問

    画像はアップロードされますか?

    いいえ。テキスト認識はすべてブラウザ内でローカルに実行されます (WebAssembly)。画像は端末から外に出ません。機密文書を扱う場合に特に重要な利点です。

    どの言語に対応していますか?

    日本語・英語・ドイツ語をはじめ、フランス語・スペイン語・ロシア語・アラビア語・ヘブライ語・ヒンディー語・韓国語・中国語など100以上の言語に対応しています。特殊文字や文字体系を正確に認識するには、リストから正しい言語を選んでください。

    手書き文字は認識できますか?

    いいえ。印刷テキストのみ安定して認識できます。手書き文字の認識は保証されません。

    認識結果に誤りがあるのはなぜですか?

    OCRの精度は画像の品質に依存します。鮮明・水平・高コントラストの画像は精度が高く、傾き・ぼけ・暗さがあると精度が落ちます。数字や固有名詞は必ず確認してください。

    スキャンしたPDFも認識できますか?

    はい。スキャンPDF専用の「PDF OCR」ツールをご利用ください。スキャンPDFを直接検索可能にする、またはテキストのみで出力できます。個別の画像に変換する手間がかかりません。

    関連ツール

    画像を圧縮 · EPUBをTXTに変換 · 証明写真 35×45 · PDF OCR 検索可能化 · PDFをJPGに変換