OCR 是什麼?認識光學字元辨識

OCR 是 Optical Character Recognition(光學字元辨識)的縮寫,能將含有文字的圖片轉成機器可讀取的數位文字。這篇完整指南會說明 OCR 的運作方式,以及為什麼它已成為數位世界中不可或缺的技術。
以下章節介紹的是一般 OCR 技術。版面重建、翻譯、自動語言偵測與手寫辨識模型等功能,會因產品而異。本站的圖片轉文字工具,是以手動選擇的一種語言,從單張圖片擷取純文字;並不提供上述更廣泛的功能。
OCR 是什麼?
OCR(Optical Character Recognition,光學字元辨識)是一項能做到以下事情的技術:
- 辨識文字:找出圖片、掃描文件與照片中的文字
- 轉換視覺文字:轉成可編輯的數位格式
- 支援搜尋:讓原本無法搜尋的圖片內容可以被檢索
- 自動輸入資料:從紙本文件擷取資訊
OCR 技術如何運作

步驟 1:取得圖片
流程從取得圖片開始:
- 掃描紙本文件
- 使用相機拍照
- 擷取螢幕畫面
- 匯入現有圖片
步驟 2:圖片前處理
為圖片分析做準備:
- 二值化 - 轉成黑白
- 降低雜訊 - 移除斑點與影像瑕疵
- 傾斜校正 - 將傾斜的文字拉正
- 版面分析 - 辨識文字區域
步驟 3:字元辨識
透過演算法辨識文字:
- 模式比對 - 與已知字形比較
- 特徵偵測 - 找出獨特的字元特徵
- 機器學習 - 使用以數百萬筆範例訓練的神經網路
- 上下文分析 - 利用語言規則提升準確度
步驟 4:後處理
進一步修正結果:
- 拼字檢查 - 修正明顯錯誤
- 格式保留 - 維持結構
- 信心評分 - 顯示辨識結果的確定程度
OCR 的類型
基礎 OCR
- 辨識使用標準字型的印刷文字
- 適合清晰、高品質的圖片
- 處理簡單文件時最準確
智慧字元辨識(ICR)
- 處理手寫文字
- 透過機器學習調整辨識能力
- 隨訓練持續改善
智慧詞彙辨識(IWR)
- 辨識完整詞語
- 更適合草寫文字
- 結合上下文進行處理
光學標記辨識(OMR)
- 偵測標記與核取方塊
- 用於問卷與測驗
- 二元判斷(有標記/無標記)
影響 OCR 準確度的因素
| 因素 | 對準確度的影響 |
|---|---|
| 圖片品質 | 高 |
| 字型類型 | 中至高 |
| 文字對比 | 高 |
| 文件狀況 | 中 |
| 語言複雜度 | 中 |
| 手寫或印刷文字 | 高 |
OCR 的常見應用

文件數位化
將紙本檔案轉成可搜尋的數位檔案。
自動輸入資料
從表單、發票與收據中擷取資訊。
無障礙應用
讓螢幕閱讀器能讀取印刷內容。
翻譯
擷取文字,供翻譯服務使用。
訴訟證據開示
搜尋掃描的法律文件。
銀行業務
處理支票與金融文件。
試用 OCR 技術
使用圖片轉文字工具,選取一張 JPG/JPEG、PNG、WebP、GIF、BMP 或 TIFF 圖片。送出前,請從 15 種辨識語言中選擇一種;一開始預選的是英文。辨識會在伺服器上執行。請將結果與圖片比對,再複製或下載純文字。工具不會翻譯,也不會重建文件版面。
本站不接受直接輸入 PDF。請先使用 PDF 轉圖片,再逐一辨識所需頁面的圖片。圖片限制為 20 MB、每一邊最多 8192 px,以及總像素數最多 2,500 萬。所有限制都必須同時符合。
OCR 與人工輸入資料的比較
| 項目 | OCR | 人工輸入 |
|---|---|---|
| 速度 | 幾秒 | 幾分鐘至數小時 |
| 成本 | 免費至低成本 | 人力成本 |
| 準確度 | 取決於圖片與辨識模型 | 取決於工作內容與校對 |
| 處理量 | 受檔案、處理資源與請求限制影響 | 受可用時間與人力限制 |
| 一致性 | 高 | 不一定 |
OCR 的限制
仰賴圖片品質
圖片品質不佳會大幅降低準確度。
手寫辨識的挑戰
多樣的手寫風格較難辨識。
複雜版面
表格、分欄與混合內容可能讓 OCR 混淆。
語言限制
不同語言與文字系統的支援程度並不相同。
OCR 的未來
AI 整合
深度學習持續改善準確度與功能。
即時處理
行動裝置已能在相機中提供即時 OCR。
多模態辨識
結合圖片、文字與版面理解。
雲端處理
透過網路服務使用強大的 OCR 功能。
常見問題
OCR 的準確率是 100% 嗎?
辨識準確度取決於來源圖片、語言、字體樣式與版面。本站不承諾固定的準確率。請選取具有代表性的範例與原始內容比對,尤其要檢查姓名與數字;模型信心分數不是實際測量出的字元正確率。
OCR 可以辨識任何字型嗎?
大多數標準字型都有良好效果。裝飾性或特殊字型的準確度可能較低。
OCR 能辨識手寫字嗎?
可以,但準確度會因字跡是否清楚而有很大差異。
OCR 和文字擷取是一樣的嗎?
OCR 是從像素辨識字元。文字擷取的範圍更廣,也包括直接讀取數位 PDF 中已內嵌的文字,不必進行圖片辨識。本站的 OCR 表單接受圖片;請先將掃描 PDF 的頁面轉成圖片。
OCR 可以辨識多種語言嗎?
部分 OCR 系統支援自動偵測,或同時使用多種辨識語言。本站需要手動從 15 種語言中選擇一種,不提供自動偵測或多種語言合併選取。請仔細檢查混合語言文字,或將適合的區域裁切後分別處理。
結語
OCR 技術改變了我們處理印刷與手寫文字的方式。歡迎試用免費 OCR 工具,親自體驗這項技術。