選單
所有文章

圖片轉文字:免費擷取任何照片中的文字(線上 OCR)

閱讀約 7 分鐘免費 · 免註冊

需要把照片裡的文字取出來嗎?不論是掃描的收據、白板照片、文件截圖,還是路牌照片,**OCR(光學字元辨識,Optical Character Recognition)**都能把圖片中的像素變成真正的文字,讓你複製、編輯和搜尋。這篇指南會說明如何使用本站免費的圖片轉文字 (OCR)工具。辨識作業在我們的伺服器上執行:你的檔案會透過加密連線傳送,文字擷取完成後就會立即刪除。


什麼是 OCR?

OCR 是 Optical Character Recognition(光學字元辨識)的縮寫。這項技術會分析圖片,辨識字母、數字和標點符號的形狀,進而產生機器可讀的文字。

現代的 OCR 引擎使用以數百萬個印刷與手寫字元訓練出來的神經網路,能辨識各種字型、大小、語言和圖片條件下的文字,即使有些許傾斜或模糊也沒問題。

OCR 讓以下這些事情得以實現:

  • 銀行把支票和身分證件數位化
  • Google Search 為圖片內的文字建立索引
  • 郵政服務辨讀信封上的手寫地址
  • 檔案管理人員讓數百萬本掃描的書籍可以被搜尋

同樣的技術,在這裡可以免費使用。


如何從圖片擷取文字:逐步說明

圖片轉文字 (OCR)工具會在我們的伺服器上執行 Tesseract OCR。你的圖片會透過加密的 HTTPS 連線上傳,擷取出文字後,上傳的檔案就會從伺服器刪除。

步驟 1:開啟圖片轉文字 (OCR)工具

前往 want2convert.com/image-to-text。你會看到一個簡單的上傳區和語言選擇器。

步驟 2:上傳圖片

把圖片拖放到上傳區,或點擊從裝置中選取。支援的格式有 JPG、PNG、TIFF、BMP、WebP 和 PDF,大小上限為 50 MB。掃描文件時,請使用可用的最高解析度:300 DPI 以上能得到最好的效果。

步驟 3:選擇語言(如有需要)

預設情況下,引擎會辨識英文。這個工具也支援斯瓦希里語(Kiswahili)、法文和阿拉伯文:擷取前,請從下拉選單選擇圖片中文字的語言。使用正確的語言模型,能大幅提升帶重音符號的字元和各語言特有字母組合的準確度。其他語言目前尚不支援。

步驟 4:點擊「擷取文字」

點擊按鈕。你的檔案會傳送到我們的伺服器,先放大並轉成灰階以提升辨識效果,再由 Tesseract 讀取。處理時間通常只要幾秒,視圖片大小和文字密度而定;請求大約兩分鐘後會逾時。

步驟 5:複製或下載結果

擷取出的文字會顯示在文字區域中。你可以:

  • 複製到剪貼簿 — 直接貼到 Word、Google 文件或任何文字編輯器
  • 下載 .txt — 把結果儲存成 .txt 檔案

適合 OCR 的來源圖片有哪些條件

OCR 的準確度在很大程度上取決於輸入圖片的品質。以下是影響最大的幾點:

解析度: 文字需要足夠的像素才看得清楚。在光線良好、距離適中(30–50 公分)的情況下用手機拍攝的文件照片,通常效果不錯。要清楚辨識小字,實用的最低解析度約為 150–200 DPI;300 DPI 是 OCR 用於檔案典藏掃描的標準。

對比度: 淺色背景上的深色文字,能給引擎最清楚的訊號。褪色的墨水、白紙上的淺灰色文字,或有花紋背景上的彩色文字,都會降低準確度。

清晰度: 因手震或對焦問題造成的模糊圖片,是 OCR 出錯的頭號原因。拍攝文件時請把手機放在穩定的平面上。手機的微距模式很適合拍攝小字文件。

方向: 嚴重傾斜或旋轉的文字會降低準確度。OCR 引擎可以處理輕微的歪斜(幾度),但以大角度拍攝的頁面效果較差。如有需要,請先用圖片旋轉工具把照片轉正。

雜訊與陰影: 摺痕、頁面上的陰影和背景紋理都會降低準確度。請把文件平放在淺色桌面上,在光線均勻的環境下拍攝。


準確度:OCR 能做到與做不到的事

OCR 對乾淨、高對比的印刷文件非常準確,輸入良好時字元準確率常達 99% 以上。不過這項技術有一些實際的限制,值得了解:

| 輸入類型 | 預期準確度 | |------------|------------------| | 乾淨的掃描印刷文件(300 DPI) | 98–99%+ | | 清晰的印刷文字手機照片 | 90–97% | | 褪色或低對比的印刷品 | 70–85% | | 手寫(工整、一致) | 60–80% | | 手寫(連筆、字跡多變) | 40–65% | | 高度風格化的字型或標誌 | 30–60% | | 雜訊或背景嚴重的圖片中的文字 | 50–75% |

在良好條件下,印刷文字的結果可望近乎完美。請務必校對輸出內容:數字或姓名中只要錯一個字元,就可能造成實際後果。


圖片轉文字的常見用途

掃描文件與 PDF

辦公室仍然要處理堆積如山的紙本文件。當你收到以 PDF 或圖片形式提供的掃描合約、表單或信件時,OCR 能把它轉成可搜尋、可編輯的文件。擷取文字後,可以貼到 Word 或 Google 文件中編輯,或存成檔案,再用 Ctrl+F 搜尋。

收據與發票

拍下收據是追蹤支出的常見做法。OCR 能擷取明細、總額和商家名稱,讓你不必重新輸入,直接貼到試算表或費用報告中。

名片

用手機快速拍下名片,再交給 OCR 處理,就能取得聯絡人的姓名、職稱、電話、電子郵件和公司,直接複製到通訊錄應用程式。

文章與網頁截圖

如果你需要引用截圖內容,或從以圖片為基礎的 PDF(掃描的書籍、無法選取文字的 PDF)複製文字,OCR 會把內容擷取成真正可用的文字。

白板照片

會議結束後,白板筆記的照片往往躺在相簿裡沒人處理。OCR 能把它們變成文字檔或可搜尋的筆記。

書籍與檔案數位化

掃描舊書、報紙和歷史紀錄的研究人員與系譜研究者,會使用 OCR 讓這些檔案可供搜尋。這裡使用的開源引擎 Tesseract,廣泛應用於檔案數位化專案。

翻譯工作流程

先從圖片擷取文字,再貼到翻譯工具中。比起手動重打外語文件、菜單或標誌照片上的文字,這樣快得多。


OCR 與複製貼上:何時該用哪一個

如果你處理的是含有文字層的數位 PDF,Ctrl+A + Ctrl+C(全選、複製)會比 OCR 更快、更準確。以下情況請使用 OCR:

  • PDF 是掃描的圖片(沒有文字層)
  • 來源是照片或截圖
  • 文件不允許選取文字(鎖定的 PDF,不過你可能也想先解除鎖定)
  • 文字位於實體文件、標誌或白板上

常見問題

這個 OCR 工具真的免費嗎?
是的,完全免費。不需要帳號、不需要訂閱,輸出結果也沒有浮水印。

我的圖片安全嗎?
你的圖片或 PDF 會透過加密(HTTPS)連線傳送到我們的伺服器,在那裡以 Tesseract OCR 處理,文字擷取完成後立即刪除。我們不保留副本,也不需要帳號。由於檔案是在伺服器上處理,請避免上傳你不願透過網際網路傳送的文件。

支援哪些語言?
預設為英文。你也可以從語言選擇器中選擇斯瓦希里語(Kiswahili)、法文或阿拉伯文。其他語言目前尚不支援。

準確度如何?
對於解析度足夠、乾淨的印刷文字,準確度通常非常高。手寫或品質不佳的圖片則較低。重要文件請務必校對輸出內容。

能辨識手寫文字嗎?
OCR 對手寫的辨識能力有限。它最適合印刷文字,手寫筆記可能效果不佳,連筆字尤其如此。

圖片大小上限是多少?
上傳上限為 50 MB,請求大約兩分鐘後會逾時。非常大的圖片可能處理較慢;在 OCR 之前先用圖片尺寸調整工具把寬度縮小到 2000–3000 像素,通常能加快速度又不影響準確度。

可以從 PDF 擷取文字嗎?
可以,你可以直接上傳 PDF;系統會逐頁轉譯並讀取。如果 PDF 很大,或你想要更多控制,也可以先用PDF 轉 JPG工具把頁面存成 JPG 或 PNG,再對圖片執行 OCR。

為什麼有些字元會出錯?
OCR 的錯誤多半來自解析度低、模糊、對比度低或不常見的字型。請試著提升輸入圖片的品質後重新執行。對於固定出現的錯誤(例如把 l 讀成 1),請在擷取後手動修正輸出內容。


相關工具

  • 圖片尺寸調整 — OCR 之前先放大小圖片,以提升準確度
  • 圖片旋轉 — OCR 之前先把傾斜的照片擺正
  • PDF 轉 JPG — 把掃描的 PDF 頁面轉成圖片以進行 OCR
  • 圖片壓縮 — 縮小圖片大小,同時保留 OCR 所需的解析度
  • JPG 轉 PNG — 在對小字文件進行 OCR 之前轉成 PNG,以保有無損品質
  • 圖片裁切 — 執行 OCR 前,先把照片中的文字區域單獨裁出來

免費試用,免註冊

多數工具在您的瀏覽器中執行,因此檔案會留在您的裝置上。少數工具會將檔案上傳至我們的伺服器,並在處理後刪除。

瀏覽所有工具