TapToConvert すべての変換

ホーム / ツール / 画像からテキスト

画像からテキスト

64言語に対応したOCRで、写真、スクリーンショット、スキャン画像から文字をコピーします。JPG、PNG、WebP、HEICなどに対応。画像は端末の外に出ることはありません。

ここにファイルをドロップ画像を選択 ファイルはアップロードされません。端末が処理できるサイズならいくらでも対応します。

URLからファイルを追加

ファイルは当サイトのサーバーを経由せず、ブラウザがそのWebサイトから直接取得します。そのサイトが他のWebサイトからのファイルのダウンロードを許可している場合に使えます。

設定

ファイルを追加して始めましょう。

    画像からテキストの仕組み

    文書の写真、スクリーンショット、スキャンしたページをドロップすると、中の文字が認識され、コピー、編集、検索できるプレーンテキストとして保存されます。これはOCR(光学文字認識)で、多くの文書スキャナーで使われているオープンソースのエンジンTesseractが、このタブ内で行います。

    変換する前に、64の言語から文字の言語を選んでください。英語と主要なヨーロッパ言語、ロシア語、アラビア語、ペルシア語、ウルドゥー語、ヘブライ語、ヒンディー語、ベンガル語、タミル語などインドの主要な文字、中国語、日本語、韓国語(横書きと縦書き)、タイ語、ベトナム語などです。ダウンロードされるのは選んだ言語のモデルだけで、ペルシア語の約0.4 MBからサンスクリット語の5.7 MBまであり、英語は約3 MBです。約4 MBのOCRエンジンと同様に、次回のためにキャッシュされます。

    通常のサイズのくっきりした印刷文字は非常に正確に読み取れます。手書き文字、非常に小さいフォントや装飾的なフォント、暗い場所、ぶれ、斜めから撮った写真では精度が下がります。レイアウトは保たれず、出力は改行付きで読む順番に並んだ文字で、ページのデザインを写したものではありません。

    認識はお使いの端末上で行われるため、レシート、身分証明書、手紙など、アップロードしたくない画像にも適しています。

    テキストファイルには画像と同じ名前が付けられます。複数の画像を一度に読み取れ、画像ごとにテキストファイルができるため、レシートの束や、撮影した文書の各ページに向いています。精度が最も高いのは、明るい背景に暗い文字で、通常の印刷以上の大きさの場合です。Webページや文書のスクリーンショットは、文字がもともとくっきりしているため、ほぼ完璧に読み取れます。

    画像からテキストのオプションの説明

    言語64言語。英語、スペイン語、フランス語、ドイツ語、ロシア語、アラビア語、ヒンディー語、ベンガル語、中国語、日本語、韓国語などを含み、中国語、日本語、韓国語には縦書き用のモデルもあります。
    出力プレーンテキストファイル、UTF-8。
    英語の単語も読み取る選んだ言語と英語を一緒に使って読み取ります。混在した文字向けです。
    エンジン約4 MBのTesseractと、選んだ言語のモデル(英語は約3 MB)。キャッシュされます。
    レイアウト保たれません。文字は読む順番で出力されます。

    使うべき場面

    OCRを使えば、スクリーンショットから引用をコピーしたり、スキャンした手紙の文章を打ち直さずに取り出したり、メモの写真を検索したり、看板やメニューの文字を翻訳ツールに貼り付けて翻訳したり、画像内の文字を文書で再利用したりできます。

    変換する前に画像を文字の部分だけに切り抜き、明るい場所で正面から撮影しましょう。どちらも精度に大きく影響します。

    この変換ツールについて

    このページは最もよくある変換の1つへの近道で、同じ変換先に変換できるすべての元の形式に対応しています。このサイトの他のページと同じエンジンを使っています。動画と音声にはWebAssemblyにコンパイルされたffmpeg、画像からの文字の読み取りにはTesseractを使い、どちらもブラウザ内で動作します。エンジンは初めてボタンを押したときにダウンロードされ、次回以降のためにキャッシュされます。正確な形式がわかっている場合は、MP4からGIFへやJPGからTXTへのような専用のページでその組み合わせの詳細を説明していますが、このページで得られる結果も同じです。

    画像からテキストのトラブルシューティング

    「文字を認識できませんでした」

    画像がぼやけているか、小さすぎるか、別の言語である可能性があります。より鮮明な画像を試し、文字の部分だけに切り抜き、正しい言語を選んでください。

    文字が間違っている

    言語の設定を確認してから、より高解像度の画像を試してください。装飾的なフォントや手書き文字は読み取りにくくなります。

    PDFから文字を取り出したい

    PDFに選択できる文字がある場合は、PDFからTXTへの変換を使ってください。スキャンの場合は、先にページをJPGに変換してからここで使ってください。

    画像からテキストの使い方(手順)

    1. 「画像を選択」を押すか、枠にファイルをドラッグします。
    2. 必要に応じてオプションを設定してください。ほとんどの用途では初期設定で十分です。
    3. 「テキストを抽出」を押します。処理はお使いの端末上で行われます。
    4. 結果をダウンロードボタンで保存します。

    オンラインで行っても安全ですか?

    ほとんどのオンラインツールでいう「オンライン」とは、ファイルが企業のサーバーにアップロードされ、そこで処理され、削除されるまでしばらく保存されることを意味します。ここではそうではありません。ページがツールのコードをブラウザにダウンロードし、ファイルはお使いの端末上のタブ内で読み込まれ、処理されます。ファイルがTapToConvertやその他の誰かに送信されることはありません。

    ご自身で確認することもできます。ページとエンジンの読み込みが終わったらWi-Fiをオフにしてみてください。ツールはそのまま動作します。つまり、順番待ちも1日あたりの上限もなく、サーバーによるファイルサイズの上限もありません。唯一の上限は、ブラウザが1つのタブに割り当てるメモリです。

    画像からテキストのよくある質問

    画像からテキストへの変換は無料ですか?

    はい。画像の枚数に制限もありません。

    手書き文字も読み取れますか?

    きれいな手書き文字なら読み取れることもありますが、Tesseractは印刷文字向けに作られているため、誤りがあると考えてください。

    どの画像形式が使えますか?

    JPG、PNG、WebP、HEIC、GIF、BMP、TIFF、AVIFです。

    画像はアップロードされますか?

    いいえ。認識はブラウザ内で行われます。

    無料ですか?

    はい。会員登録不要、透かしなし、利用回数の制限もありません。TapToConvertは広告収入で運営されています。

    ファイルはアップロードされますか?

    いいえ。すべての処理は、お使いの端末上のブラウザのタブ内で行われます。

    MP4からMP3、HEIC、PDF結合、動画圧縮などを試してみてください。