怎麼用
- 選擇圖片、拖進虛線框,或直接貼上剪貼簿圖片。先確認預覽是你要辨識的那張。
- 選「繁體中文+英文」或「只有英文」,按「開始辨識」。載入資料及辨識都有進度,過程中可按「取消」。
- 核對文字,直接在文字框修正錯字。要去掉換行可選「合併成段落」,再複製或下載 UTF-8 的 .txt 檔。
- 按「清除」移除圖片與結果;換一張圖片會清掉上一張結果並停止上一個辨識工作。
怎麼拍比較準
讓紙面光線均勻,避開反光與陰影;靠近一點,讓字夠大又保持清晰。相機盡量正對文字,避免歪斜或紙面彎曲。可先裁掉無關背景,保留文字四周的留白;截圖請使用原始尺寸,避免反覆壓縮。
想調整圖片大小可用圖片壓縮,但過度縮小可能讓文字更難讀。這頁讀的是圖片上的文字;圖片裡的 QR Code 內容請用QR Code 掃描。
辨識方式與限制
OCR(光學文字辨識)使用 Tesseract 的 LSTM 模型,將圖片中的字形轉成文字。圖片先由 Canvas 等比例縮小到長邊最多 3000 px,透明部分補白底,再送到 Web Worker 辨識。這是本頁的處理尺寸,不是圖片格式的限制;低記憶體裝置仍可能讀取失敗。
手寫、直排、藝術字、表格、低解析度或模糊照片的辨識率較差。結果是純文字,不保留字型、欄位、表格或原始版面。信心分數只是引擎參考值,不代表文字正確率;重要內容需自行核對。
兩種模式都整理空白,去掉相鄰中日韓文字之間的空白,保留中文與英數、英文單字間的一個空白,全形/中日韓標點前後不留空白,全形空白視同空白,半形標點前後不額外去掉空白。「保留換行」沿用引擎輸出的換行;「合併成段落」另將換行併成空白。英文因換行被拆開的單字、連字號及段落邊界仍需自行調整。
隱私
圖片、辨識及編輯後的文字只在你的瀏覽器處理,不上傳檔案或結果,不呼叫外部辨識 API,也不從 CDN 載入程式庫。本頁不將圖片、文字或設定存入 localStorage、cookie 或 IndexedDB;每種語言設定首次使用才載入資料,同一頁切回用過的設定不必重新下載;取消後該設定需重建,重新整理仍要重新載入,語言檔可能由瀏覽器一般 HTTP 快取保留。全站可能記錄按鈕操作事件,不包含圖片內容、檔名或結果文字。
常見問題
圖片會上傳嗎?
圖片與辨識結果只在你的瀏覽器處理,不會上傳到本站伺服器。辨識時會從本站載入程式與語言資料;全站可能記錄按鈕操作事件,不包含圖片或結果文字。
為什麼第一次辨識要等比較久?
需要先載入辨識核心與語言資料。繁體中文資料約 1.7 MB、英文約 3 MB,辨識核心另外約 4 MB,畫面會顯示載入進度。同一頁連續辨識會重用已載入的 Worker 與語言資料;每種語言設定首次使用才載入資料,同一頁切回用過的設定不必重新下載;取消後該設定需重建,另一種設定仍可重用。重新整理或下次再來仍要重新載入,是否走 HTTP 快取由瀏覽器決定。
手機可以貼上截圖嗎?
剪貼簿有圖片且瀏覽器提供圖片貼上事件時,可以直接貼上;電腦可用 Ctrl+V。手機無法貼上時,先儲存截圖,再按選圖片。貼上純文字時仍可正常編輯結果。
表格、手寫或直排文字可以辨識嗎?
這頁主要適合清楚的橫排印刷文字。手寫、直排、藝術字、表格及低解析度圖片的結果可能較差,不會還原表格或原始版面。
信心分數很高就一定正確嗎?
不是。信心分數是辨識引擎的參考值,不代表實際正確率;姓名、金額、帳號等重要內容都要對照原圖核對。
合併段落會改掉我手動修好的文字嗎?
切到合併段落時,會整理目前文字框中的換行和空白:中文字之間不留空白,英文單字之間保留一個空白。切回保留換行會還原合併前的文字;若你在合併模式中修改過,會保留修改後的內容,原換行無法自動還原。
規格與來源
- Tesseract.js 7.0.0,Apache-2.0 授權。使用 npm 官方套件的原始 Worker,從本站載入。來源:Tesseract.js 原始專案;授權全文。
- tesseract.js-core 6.1.2,Apache-2.0 授權。使用本站已有的 LSTM WebAssembly 核心,依瀏覽器支援選擇 SIMD 或一般版本。來源:核心原始專案;授權全文。
- 語言資料 4.0.0_best_int:chi_tra 與 eng,分別來自 npm 官方套件
@tesseract.js-data/chi_tra1.0.0 與@tesseract.js-data/eng1.0.0(套件 MIT,模型資料 Apache-2.0)。來源:Tesseract.js 語言資料、Tesseract 原始語言模型與授權;使用本站已有的 gzip 原檔,未修改。 - 辨識前影像處理參考:Tesseract:改善辨識品質。本頁支援 PNG、JPG、WebP,不直接讀取 PDF。