0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR:画像から文字へ
光学文字認識(OCR)で画像やスクリーンショットから文字を抽出します。すべてブラウザー内で処理され、画像はどのサーバーにもアップロードされません。

画像をドラッグするかクリックして選択

PNG, JPEG, WebP, GIF, BMP

画像に含まれる言語を1つ以上選んでください

仕組み

OCR(光学文字認識)は、画像—写真、スクリーンショット、スキャンした文書—の中にある文字を、コピー・検索・どこにでも貼り付けできる編集可能なテキストに変換します。

精度を高めるために1つ以上の言語を選べます。正しい言語を指定すると、アクセント記号・特殊文字・単語全体をエンジンがより正しく解釈します。ある言語を初めて使うときにそのモデルがダウンロードされ、以降のために保存されます。

認識はすべて WebAssembly を使ってブラウザー内で行われ、画像はどのサーバーにもアップロードされません。結果には信頼度の推定値が含まれ、読み取りの確からしさがわかります。

ユースケース

  • 選択できないスクリーンショットの文字をコピーする。
  • スキャンした文書・請求書・レシートを編集用にデジタル化する。
  • 写真からコードの断片やエラーメッセージを抽出する。
  • 画像から文字を取り出して翻訳したり検索したりする。

よくある質問

画像はどこかのサーバーにアップロードされますか?

いいえ。認識は完全にブラウザー内で実行され、画像が端末から出ることはありません。ダウンロードされるのは、選択した言語モデルだけで、一度限りです。

なぜテキストの言語を選ぶ必要があるのですか?

言語ごとに専用の学習済みモデルがあります。正しい言語を選ぶと、特にアクセント記号やその言語固有の文字で精度が大きく向上します。画像に複数の言語が混在する場合は、同時に複数選べます。

より良い結果を得るには?

文字と背景のコントラストが良い、鮮明で明るい画像を使ってください。水平で歪みのない文字は、斜め・ぼやけた・手書きの写真よりもうまく認識されます。

どの画像形式を使えますか?

PNG、JPEG、WebP、GIF、BMP など一般的な形式を使えます。文書の場合は、解像度の高いスクリーンショットやスキャンのほうが良い結果になります。