0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR:画像・PDFをテキストに
画像・スクリーンショット・PDFからテキストを抽出します。PDFでは、文書自体のテキスト(署名やフィールドを含む)と画像の光学式文字認識(OCR)を組み合わせます。すべての処理はブラウザー内で行われ、ファイルがサーバーにアップロードされることはありません。

画像またはPDFをドラッグするか、クリックして選択してください

PDF, PNG, JPEG, WebP, GIF, BMP

画像に含まれる言語を1つ以上選んでください

仕組み

OCR(光学式文字認識)は、画像やPDF(写真、スクリーンショット、スキャンした文書)の中にある文字を、コピー・検索・貼り付けができる編集可能なテキストに変換します。

精度を高めるために1つ以上の言語を選べます。正しい言語を指定すると、アクセント記号・特殊文字・単語全体をエンジンがより正しく解釈します。ある言語を初めて使うときにそのモデルがダウンロードされ、以降のために保存されます。

認識はすべてWebAssemblyによりブラウザー内で行われ、ファイルはどのサーバーにもアップロードされません。結果には信頼度の推定値が含まれ、読み取りの信頼性がわかります。

ユースケース

  • 選択できないスクリーンショットの文字をコピーする。
  • スキャンした文書・請求書・レシートを編集用にデジタル化する。
  • 写真からコードの断片やエラーメッセージを抽出する。
  • 画像から文字を取り出して翻訳したり検索したりする。
  • デジタルでもスキャンでも、PDFからテキストを抽出して再利用する。

よくある質問

画像はどこかのサーバーにアップロードされますか?

いいえ。認識は完全にブラウザー内で実行され、画像が端末から出ることはありません。ダウンロードされるのは、選択した言語モデルだけで、一度限りです。

なぜテキストの言語を選ぶ必要があるのですか?

言語ごとに専用の学習済みモデルがあります。正しい言語を選ぶと、特にアクセント記号やその言語固有の文字で精度が大きく向上します。画像に複数の言語が混在する場合は、同時に複数選べます。

より良い結果を得るには?

文字と背景のコントラストが良い、鮮明で明るい画像を使ってください。水平で歪みのない文字は、斜め・ぼやけた・手書きの写真よりもうまく認識されます。

どの形式を使えますか?

一般的な形式の画像(PNG、JPEG、WebP、GIF、BMP)に加えて、PDFファイルも使用できます。文書の場合、解像度の高いスクリーンショットやスキャンほど良い結果が得られます。

PDFはどのように処理されますか?

ページごとに処理し、利用可能なすべてのテキストを組み合わせます。PDF自体のテキスト(フォームフィールドや電子署名を含む)を直接かつ正確に抽出し、さらに画像内のテキストをOCRで認識します。「デジタル」PDFは即座に読み取れますが、スキャンしたものや画像が多いものは時間がかかることがあります。