0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR:圖片和 PDF 轉文字
從圖片、截圖或 PDF 中擷取文字。對於 PDF,會將文件本身的文字(包括簽名和欄位)與圖片的光學字元辨識(OCR)結合起來。整個過程都在你的瀏覽器中完成,不會將檔案上傳到任何伺服器。

拖入圖片或 PDF,或點擊選擇

PDF, PNG, JPEG, WebP, GIF, BMP

選擇圖片中出現的一種或多種語言

運作方式

OCR(光學字元辨識)可將出現在圖片或 PDF 中的文字——照片、截圖或掃描的文件——轉換為可編輯的文字,方便你複製、搜尋或貼上到任何地方。

你可以選擇一種或多種語言以提高準確度:指定正確的語言有助於引擎更好地辨識重音符號、特殊字元和完整單字。首次使用某種語言時會下載其模型,之後會儲存以備下次使用。

所有辨識都透過 WebAssembly 在你的瀏覽器中完成:檔案不會上傳到任何伺服器。結果包含信心度估計,讓你了解辨識的可靠程度。

使用情境

  • 在無法選取時複製螢幕截圖中的文字。
  • 將掃描的文件、發票或收據數位化以便編輯。
  • 從照片中擷取程式碼片段或錯誤訊息。
  • 從圖片中還原文字以進行翻譯或搜尋。
  • 從 PDF(無論是數位版還是掃描版)中擷取文字以便重複使用。

常見問題

我的圖片會上傳到伺服器嗎?

不會。辨識完全在你的瀏覽器中進行,圖片絕不會離開你的裝置。只有你選擇的語言模型會下載一次。

為什麼要選擇文字語言?

每種語言都有自己訓練的模型。選擇正確的語言能顯著提高準確度,尤其是對重音符號和該語言特有的字元。如果圖片中混合了多種語言,你可以同時選擇多種。

如何取得更好的結果?

使用清晰、光線充足、文字與背景對比良好的圖片。水平且無變形的文字比傾斜、模糊或手寫的照片效果更好。

我可以使用哪些格式?

你可以使用常見格式的圖片(PNG、JPEG、WebP、GIF 和 BMP),也可以使用 PDF 檔案。對於文件,高解析度的截圖或掃描效果更好。

PDF 是如何處理的?

會逐頁處理並合併所有可用文字:PDF 本身的文字(包括表單欄位和數位簽章)會被直接、準確地擷取,圖片中的文字也會透過 OCR 辨識。「數位版」PDF 可即時讀取;掃描版或包含大量圖片的 PDF 可能需要更久。