0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR:圖片和 PDF 轉文字
從圖片、截圖或 PDF 中擷取文字。對於 PDF,會將文件本身的文字(包括簽名和欄位)與圖片的光學字元辨識(OCR)結合起來。整個過程都在你的瀏覽器中完成,不會將檔案上傳到任何伺服器。
拖入圖片或 PDF,或點擊選擇
PDF, PNG, JPEG, WebP, GIF, BMP
西班牙文
運作方式
OCR(光學字元辨識)可將出現在圖片或 PDF 中的文字——照片、截圖或掃描的文件——轉換為可編輯的文字,方便你複製、搜尋或貼上到任何地方。
你可以選擇一種或多種語言以提高準確度:指定正確的語言有助於引擎更好地辨識重音符號、特殊字元和完整單字。首次使用某種語言時會下載其模型,之後會儲存以備下次使用。
所有辨識都透過 WebAssembly 在你的瀏覽器中完成:檔案不會上傳到任何伺服器。結果包含信心度估計,讓你了解辨識的可靠程度。
使用情境
- 在無法選取時複製螢幕截圖中的文字。
- 將掃描的文件、發票或收據數位化以便編輯。
- 從照片中擷取程式碼片段或錯誤訊息。
- 從圖片中還原文字以進行翻譯或搜尋。
- 從 PDF(無論是數位版還是掃描版)中擷取文字以便重複使用。
常見問題
我的圖片會上傳到伺服器嗎?
不會。辨識完全在你的瀏覽器中進行,圖片絕不會離開你的裝置。只有你選擇的語言模型會下載一次。
為什麼要選擇文字語言?
每種語言都有自己訓練的模型。選擇正確的語言能顯著提高準確度,尤其是對重音符號和該語言特有的字元。如果圖片中混合了多種語言,你可以同時選擇多種。
如何取得更好的結果?
使用清晰、光線充足、文字與背景對比良好的圖片。水平且無變形的文字比傾斜、模糊或手寫的照片效果更好。
我可以使用哪些格式?
你可以使用常見格式的圖片(PNG、JPEG、WebP、GIF 和 BMP),也可以使用 PDF 檔案。對於文件,高解析度的截圖或掃描效果更好。
PDF 是如何處理的?
會逐頁處理並合併所有可用文字:PDF 本身的文字(包括表單欄位和數位簽章)會被直接、準確地擷取,圖片中的文字也會透過 OCR 辨識。「數位版」PDF 可即時讀取;掃描版或包含大量圖片的 PDF 可能需要更久。