需要把照片裡的文字取出來嗎?不論是掃描的收據、白板照片、文件截圖,還是路牌照片,**OCR(光學字元辨識,Optical Character Recognition)**都能把圖片中的像素變成真正的文字,讓你複製、編輯和搜尋。這篇指南會說明如何使用本站免費的圖片轉文字 (OCR)工具。辨識作業在我們的伺服器上執行:你的檔案會透過加密連線傳送,文字擷取完成後就會立即刪除。
什麼是 OCR?
OCR 是 Optical Character Recognition(光學字元辨識)的縮寫。這項技術會分析圖片,辨識字母、數字和標點符號的形狀,進而產生機器可讀的文字。
現代的 OCR 引擎使用以數百萬個印刷與手寫字元訓練出來的神經網路,能辨識各種字型、大小、語言和圖片條件下的文字,即使有些許傾斜或模糊也沒問題。
OCR 讓以下這些事情得以實現:
- 銀行把支票和身分證件數位化
- Google Search 為圖片內的文字建立索引
- 郵政服務辨讀信封上的手寫地址
- 檔案管理人員讓數百萬本掃描的書籍可以被搜尋
同樣的技術,在這裡可以免費使用。
如何從圖片擷取文字:逐步說明
圖片轉文字 (OCR)工具會在我們的伺服器上執行 Tesseract OCR。你的圖片會透過加密的 HTTPS 連線上傳,擷取出文字後,上傳的檔案就會從伺服器刪除。
步驟 1:開啟圖片轉文字 (OCR)工具
前往 want2convert.com/image-to-text。你會看到一個簡單的上傳區和語言選擇器。
步驟 2:上傳圖片
把圖片拖放到上傳區,或點擊從裝置中選取。支援的格式有 JPG、PNG、TIFF、BMP、WebP 和 PDF,大小上限為 50 MB。掃描文件時,請使用可用的最高解析度:300 DPI 以上能得到最好的效果。
步驟 3:選擇語言(如有需要)
預設情況下,引擎會辨識英文。這個工具也支援斯瓦希里語(Kiswahili)、法文和阿拉伯文:擷取前,請從下拉選單選擇圖片中文字的語言。使用正確的語言模型,能大幅提升帶重音符號的字元和各語言特有字母組合的準確度。其他語言目前尚不支援。
步驟 4:點擊「擷取文字」
點擊按鈕。你的檔案會傳送到我們的伺服器,先放大並轉成灰階以提升辨識效果,再由 Tesseract 讀取。處理時間通常只要幾秒,視圖片大小和文字密度而定;請求大約兩分鐘後會逾時。
步驟 5:複製或下載結果
擷取出的文字會顯示在文字區域中。你可以:
- 複製到剪貼簿 — 直接貼到 Word、Google 文件或任何文字編輯器
- 下載 .txt — 把結果儲存成
.txt檔案
適合 OCR 的來源圖片有哪些條件
OCR 的準確度在很大程度上取決於輸入圖片的品質。以下是影響最大的幾點:
解析度: 文字需要足夠的像素才看得清楚。在光線良好、距離適中(30–50 公分)的情況下用手機拍攝的文件照片,通常效果不錯。要清楚辨識小字,實用的最低解析度約為 150–200 DPI;300 DPI 是 OCR 用於檔案典藏掃描的標準。
對比度: 淺色背景上的深色文字,能給引擎最清楚的訊號。褪色的墨水、白紙上的淺灰色文字,或有花紋背景上的彩色文字,都會降低準確度。
清晰度: 因手震或對焦問題造成的模糊圖片,是 OCR 出錯的頭號原因。拍攝文件時請把手機放在穩定的平面上。手機的微距模式很適合拍攝小字文件。
方向: 嚴重傾斜或旋轉的文字會降低準確度。OCR 引擎可以處理輕微的歪斜(幾度),但以大角度拍攝的頁面效果較差。如有需要,請先用圖片旋轉工具把照片轉正。
雜訊與陰影: 摺痕、頁面上的陰影和背景紋理都會降低準確度。請把文件平放在淺色桌面上,在光線均勻的環境下拍攝。
準確度:OCR 能做到與做不到的事
OCR 對乾淨、高對比的印刷文件非常準確,輸入良好時字元準確率常達 99% 以上。不過這項技術有一些實際的限制,值得了解:
| 輸入類型 | 預期準確度 | |------------|------------------| | 乾淨的掃描印刷文件(300 DPI) | 98–99%+ | | 清晰的印刷文字手機照片 | 90–97% | | 褪色或低對比的印刷品 | 70–85% | | 手寫(工整、一致) | 60–80% | | 手寫(連筆、字跡多變) | 40–65% | | 高度風格化的字型或標誌 | 30–60% | | 雜訊或背景嚴重的圖片中的文字 | 50–75% |
在良好條件下,印刷文字的結果可望近乎完美。請務必校對輸出內容:數字或姓名中只要錯一個字元,就可能造成實際後果。
圖片轉文字的常見用途
掃描文件與 PDF
辦公室仍然要處理堆積如山的紙本文件。當你收到以 PDF 或圖片形式提供的掃描合約、表單或信件時,OCR 能把它轉成可搜尋、可編輯的文件。擷取文字後,可以貼到 Word 或 Google 文件中編輯,或存成檔案,再用 Ctrl+F 搜尋。
收據與發票
拍下收據是追蹤支出的常見做法。OCR 能擷取明細、總額和商家名稱,讓你不必重新輸入,直接貼到試算表或費用報告中。
名片
用手機快速拍下名片,再交給 OCR 處理,就能取得聯絡人的姓名、職稱、電話、電子郵件和公司,直接複製到通訊錄應用程式。
文章與網頁截圖
如果你需要引用截圖內容,或從以圖片為基礎的 PDF(掃描的書籍、無法選取文字的 PDF)複製文字,OCR 會把內容擷取成真正可用的文字。
白板照片
會議結束後,白板筆記的照片往往躺在相簿裡沒人處理。OCR 能把它們變成文字檔或可搜尋的筆記。
書籍與檔案數位化
掃描舊書、報紙和歷史紀錄的研究人員與系譜研究者,會使用 OCR 讓這些檔案可供搜尋。這裡使用的開源引擎 Tesseract,廣泛應用於檔案數位化專案。
翻譯工作流程
先從圖片擷取文字,再貼到翻譯工具中。比起手動重打外語文件、菜單或標誌照片上的文字,這樣快得多。
OCR 與複製貼上:何時該用哪一個
如果你處理的是含有文字層的數位 PDF,Ctrl+A + Ctrl+C(全選、複製)會比 OCR 更快、更準確。以下情況請使用 OCR:
- PDF 是掃描的圖片(沒有文字層)
- 來源是照片或截圖
- 文件不允許選取文字(鎖定的 PDF,不過你可能也想先解除鎖定)
- 文字位於實體文件、標誌或白板上
常見問題
這個 OCR 工具真的免費嗎?
是的,完全免費。不需要帳號、不需要訂閱,輸出結果也沒有浮水印。
我的圖片安全嗎?
你的圖片或 PDF 會透過加密(HTTPS)連線傳送到我們的伺服器,在那裡以 Tesseract OCR 處理,文字擷取完成後立即刪除。我們不保留副本,也不需要帳號。由於檔案是在伺服器上處理,請避免上傳你不願透過網際網路傳送的文件。
支援哪些語言?
預設為英文。你也可以從語言選擇器中選擇斯瓦希里語(Kiswahili)、法文或阿拉伯文。其他語言目前尚不支援。
準確度如何?
對於解析度足夠、乾淨的印刷文字,準確度通常非常高。手寫或品質不佳的圖片則較低。重要文件請務必校對輸出內容。
能辨識手寫文字嗎?
OCR 對手寫的辨識能力有限。它最適合印刷文字,手寫筆記可能效果不佳,連筆字尤其如此。
圖片大小上限是多少?
上傳上限為 50 MB,請求大約兩分鐘後會逾時。非常大的圖片可能處理較慢;在 OCR 之前先用圖片尺寸調整工具把寬度縮小到 2000–3000 像素,通常能加快速度又不影響準確度。
可以從 PDF 擷取文字嗎?
可以,你可以直接上傳 PDF;系統會逐頁轉譯並讀取。如果 PDF 很大,或你想要更多控制,也可以先用PDF 轉 JPG工具把頁面存成 JPG 或 PNG,再對圖片執行 OCR。
為什麼有些字元會出錯?
OCR 的錯誤多半來自解析度低、模糊、對比度低或不常見的字型。請試著提升輸入圖片的品質後重新執行。對於固定出現的錯誤(例如把 l 讀成 1),請在擷取後手動修正輸出內容。
相關工具
免費試用,免註冊
多數工具在您的瀏覽器中執行,因此檔案會留在您的裝置上。少數工具會將檔案上傳至我們的伺服器,並在處理後刪除。