Menu
Tất cả bài viết

Chuyển ảnh sang văn bản: trích xuất chữ từ mọi bức ảnh miễn phí (OCR online)

11 phút đọcMiễn phí · Không cần đăng ký

Bạn cần lấy chữ ra khỏi một bức ảnh? Dù đó là hóa đơn đã quét, ảnh chụp bảng trắng, ảnh chụp màn hình tài liệu hay ảnh một tấm biển, OCR (Optical Character Recognition, nhận dạng ký tự quang học) biến điểm ảnh của hình thành văn bản thật để bạn sao chép, chỉnh sửa và tìm kiếm. Hướng dẫn này giải thích cách dùng công cụ Chuyển ảnh sang văn bản (OCR) miễn phí trên trang này. Việc nhận dạng chạy trên máy chủ của chúng tôi: tệp của bạn được gửi qua kết nối mã hóa và bị xóa ngay khi văn bản được trích xuất xong.


OCR là gì?

OCR là viết tắt của Optical Character Recognition, tức nhận dạng ký tự quang học. Đây là công nghệ phân tích một hình ảnh và nhận ra hình dạng của chữ cái, chữ số và dấu câu để tạo ra văn bản máy có thể đọc được.

Các công cụ OCR hiện đại dùng mạng nơ-ron được huấn luyện trên hàng triệu ký tự in và viết tay. Chúng nhận dạng được văn bản ở nhiều kiểu chữ, cỡ chữ, ngôn ngữ và điều kiện hình ảnh khác nhau, kể cả khi ảnh hơi nghiêng hoặc hơi mờ.

OCR là thứ giúp:

  • Ngân hàng số hóa séc và giấy tờ tùy thân
  • Google Search lập chỉ mục chữ trong hình ảnh
  • Bưu điện đọc địa chỉ viết tay trên phong bì
  • Các nhà lưu trữ giúp hàng triệu cuốn sách đã quét có thể tìm kiếm được

Công nghệ tương tự có sẵn ở đây miễn phí.


Cách trích xuất văn bản từ hình ảnh, từng bước

Công cụ Chuyển ảnh sang văn bản (OCR) chạy Tesseract OCR trên máy chủ của chúng tôi. Ảnh của bạn được tải lên qua kết nối HTTPS mã hóa, văn bản được trích xuất, rồi tệp đã tải lên bị xóa khỏi máy chủ.

Bước 1: Mở công cụ Chuyển ảnh sang văn bản (OCR)

Truy cập want2convert.com/image-to-text. Bạn sẽ thấy một khu vực tải lên đơn giản và bộ chọn ngôn ngữ.

Bước 2: Tải ảnh lên

Kéo và thả ảnh vào khu vực tải lên hoặc nhấp để chọn từ thiết bị. Các định dạng được hỗ trợ là JPG, PNG, TIFF, BMP, WebP và PDF, tối đa 50 MB. Với tài liệu quét, hãy dùng bản quét có độ phân giải cao nhất: 300 DPI trở lên cho kết quả tốt nhất.

Bước 3: Chọn ngôn ngữ (nếu cần)

Mặc định, công cụ nhận dạng tiếng Anh. Công cụ cũng hỗ trợ tiếng Swahili (Kiswahili), tiếng Pháp và tiếng Ả Rập: hãy chọn ngôn ngữ của văn bản trong ảnh từ danh sách thả xuống trước khi trích xuất. Dùng đúng mô hình ngôn ngữ giúp tăng độ chính xác đáng kể với các ký tự có dấu và mẫu chữ đặc trưng của từng ngôn ngữ. Các ngôn ngữ khác hiện chưa được hỗ trợ.

Bước 4: Nhấp “Trích xuất văn bản”

Nhấp vào nút. Tệp của bạn được gửi đến máy chủ của chúng tôi, nơi nó được phóng to và chuyển sang thang độ xám để nhận dạng tốt hơn, rồi được Tesseract đọc. Quá trình xử lý thường mất vài giây, tùy kích thước ảnh và mật độ chữ; yêu cầu sẽ hết thời gian sau khoảng hai phút.

Bước 5: Sao chép hoặc tải kết quả xuống

Văn bản trích xuất xuất hiện trong một ô văn bản. Bạn có thể:

  • Sao chép vào bộ nhớ tạm — dán trực tiếp vào Word, Google Docs hoặc bất kỳ trình soạn thảo văn bản nào
  • Tải xuống .txt — lưu kết quả thành tệp .txt

Thế nào là ảnh nguồn tốt cho OCR

Độ chính xác của OCR phụ thuộc nhiều vào chất lượng ảnh đầu vào. Đây là những yếu tố tạo khác biệt lớn nhất:

Độ phân giải: Chữ cần đủ điểm ảnh để đọc được. Ảnh tài liệu chụp bằng điện thoại trong điều kiện đủ sáng và khoảng cách hợp lý (30–50 cm) thường cho kết quả tốt. Độ phân giải tối thiểu thực tế cho chữ nhỏ rõ nét khoảng 150–200 DPI; 300 DPI là tiêu chuẩn OCR cho quét lưu trữ.

Độ tương phản: Chữ tối trên nền sáng cho công cụ tín hiệu rõ nhất. Mực phai, chữ xám nhạt trên giấy trắng hoặc chữ màu trên nền có họa tiết đều làm giảm độ chính xác.

Độ nét: Ảnh bị mờ, do rung máy hoặc lỗi lấy nét, là nguyên nhân lớn nhất gây lỗi OCR. Hãy đặt máy trên bề mặt vững khi chụp tài liệu. Chế độ macro của điện thoại hoạt động tốt với tài liệu chữ nhỏ.

Hướng ảnh: Chữ nghiêng hoặc xoay nhiều làm giảm độ chính xác. Công cụ OCR xử lý được độ nghiêng nhẹ (vài độ), nhưng các trang chụp ở góc xiên lớn cho kết quả kém hơn. Nếu cần, hãy dùng công cụ Xoay ảnh để xoay ảnh về đúng chiều trước.

Nhiễu và bóng đổ: Nếp gấp, bóng đổ trên trang giấy và họa tiết nền làm giảm độ chính xác. Hãy chụp tài liệu đặt phẳng trên bàn màu sáng với ánh sáng đều.


Độ chính xác: OCR làm được và không làm được gì

OCR rất chính xác với tài liệu in sạch, độ tương phản cao, thường đạt trên 99% ký tự đúng với đầu vào tốt. Tuy vậy, công nghệ này có những giới hạn thực tế bạn nên biết:

| Loại đầu vào | Độ chính xác dự kiến | |------------|------------------| | Tài liệu in đã quét sạch (300 DPI) | 98–99%+ | | Ảnh chụp điện thoại sắc nét của chữ in | 90–97% | | Bản in phai hoặc độ tương phản thấp | 70–85% | | Chữ viết tay (gọn gàng, đều nét) | 60–80% | | Chữ viết tay (chữ nối, thay đổi) | 40–65% | | Phông chữ cách điệu mạnh hoặc logo | 30–60% | | Chữ trong ảnh nhiễu nhiều hoặc nền rối | 50–75% |

Với chữ in trong điều kiện tốt, hãy kỳ vọng kết quả gần như hoàn hảo. Luôn kiểm tra lại kết quả: chỉ một ký tự sai trong con số hoặc tên riêng cũng có thể gây hậu quả thực sự.


Những cách dùng phổ biến của công cụ chuyển ảnh sang văn bản

Tài liệu quét và PDF

Văn phòng vẫn phải xử lý hàng đống giấy tờ. Khi bạn nhận một hợp đồng, biểu mẫu hay thư đã quét dưới dạng PDF hoặc hình ảnh, OCR biến nó thành tài liệu có thể tìm kiếm và chỉnh sửa. Sau khi trích xuất, hãy dán văn bản vào Word hoặc Google Docs để chỉnh sửa, hoặc lưu thành tệp để tìm kiếm bằng Ctrl+F.

Hóa đơn và biên lai

Chụp ảnh hóa đơn là cách quen thuộc để theo dõi chi tiêu. OCR trích xuất các dòng hàng, tổng tiền và tên nhà cung cấp để bạn dán thẳng vào bảng tính hoặc báo cáo chi phí mà không cần gõ lại.

Danh thiếp

Một bức ảnh chụp nhanh danh thiếp bằng điện thoại, đưa qua OCR, cho bạn tên, chức danh, số điện thoại, email và công ty của người đó, sẵn sàng để sao chép vào ứng dụng danh bạ.

Ảnh chụp màn hình bài viết và trang web

Nếu bạn cần trích dẫn từ ảnh chụp màn hình hoặc sao chép chữ từ một PDF dạng hình ảnh (sách đã quét, PDF không chọn được chữ), OCR sẽ trích xuất thành văn bản thật để bạn dùng.

Ảnh chụp bảng trắng

Sau cuộc họp, ảnh chụp ghi chú trên bảng trắng thường nằm yên trong thư viện ảnh mà không ai dùng đến. OCR biến chúng thành tệp văn bản hoặc ghi chú có thể tìm kiếm.

Số hóa sách và tài liệu lưu trữ

Các nhà nghiên cứu và người tìm hiểu gia phả khi quét sách cũ, báo và hồ sơ lịch sử dùng OCR để các kho lưu trữ đó có thể tìm kiếm. Tesseract, công cụ mã nguồn mở được dùng ở đây, được sử dụng rộng rãi trong các dự án số hóa tài liệu lưu trữ.

Quy trình dịch thuật

Hãy trích xuất chữ từ ảnh trước, rồi dán vào công cụ dịch. Cách này nhanh hơn rất nhiều so với việc gõ lại bằng tay chữ trong ảnh chụp tài liệu, thực đơn hay biển hiệu tiếng nước ngoài.


OCR hay sao chép-dán: khi nào dùng cái nào

Nếu bạn làm việc với PDF kỹ thuật số có lớp văn bản, Ctrl+A + Ctrl+C (chọn tất cả, sao chép) nhanh và chính xác hơn OCR. Hãy dùng OCR khi:

  • PDF là hình ảnh đã quét (không có lớp văn bản)
  • Nguồn là ảnh chụp hoặc ảnh chụp màn hình
  • Tài liệu không cho phép chọn chữ (PDF bị khóa, dù bạn cũng có thể muốn mở khóa trước)
  • Chữ nằm trên tài liệu giấy, biển hiệu hoặc bảng trắng

Câu hỏi thường gặp

Công cụ OCR này có thực sự miễn phí không?
Có, hoàn toàn miễn phí. Không cần tài khoản, không đăng ký gói, không có hình mờ trên kết quả.

Ảnh của tôi có an toàn không?
Ảnh hoặc PDF của bạn được gửi đến máy chủ của chúng tôi qua kết nối mã hóa (HTTPS), xử lý tại đó bằng Tesseract OCR và bị xóa ngay khi văn bản được trích xuất xong. Chúng tôi không lưu bản sao và không cần tài khoản. Vì tệp được xử lý trên máy chủ, bạn nên tránh tải lên những tài liệu mà bạn không yên tâm khi gửi qua internet.

Công cụ hỗ trợ những ngôn ngữ nào?
Tiếng Anh là mặc định. Bạn cũng có thể chọn tiếng Swahili (Kiswahili), tiếng Pháp hoặc tiếng Ả Rập trong bộ chọn ngôn ngữ. Các ngôn ngữ khác hiện chưa được hỗ trợ.

Độ chính xác thế nào?
Với chữ in sạch ở độ phân giải đủ tốt, độ chính xác thường rất cao. Với chữ viết tay hoặc ảnh chất lượng kém, độ chính xác thấp hơn. Luôn kiểm tra lại kết quả với các tài liệu quan trọng.

Có đọc được chữ viết tay không?
OCR chỉ nhận dạng chữ viết tay ở mức hạn chế. Công cụ hoạt động tốt nhất với chữ in, còn ghi chú viết tay có thể cho kết quả kém, nhất là chữ viết nối.

Kích thước ảnh tối đa là bao nhiêu?
Dung lượng tải lên tối đa là 50 MB và yêu cầu hết thời gian sau khoảng hai phút. Ảnh rất lớn có thể xử lý chậm; thu nhỏ chiều rộng còn 2000–3000 pixel bằng công cụ Thay đổi kích thước ảnh trước khi OCR thường giúp nhanh hơn mà không giảm độ chính xác.

Tôi có thể trích xuất văn bản từ PDF không?
Có, bạn có thể tải PDF lên trực tiếp; các trang được kết xuất và đọc lần lượt từng trang. Nếu PDF lớn hoặc bạn muốn kiểm soát nhiều hơn, bạn cũng có thể lưu các trang thành JPG hoặc PNG trước bằng công cụ Chuyển PDF sang JPG rồi chạy OCR trên các ảnh.

Tại sao một số ký tự bị sai?
Lỗi OCR thường do độ phân giải thấp, ảnh mờ, độ tương phản thấp hoặc phông chữ lạ. Hãy thử cải thiện chất lượng ảnh đầu vào rồi chạy lại. Với lỗi lặp lại có hệ thống (ví dụ l bị đọc thành 1), hãy sửa tay kết quả sau khi trích xuất.


Công cụ liên quan

  • Thay đổi kích thước ảnh — phóng to ảnh nhỏ trước khi OCR để tăng độ chính xác
  • Xoay ảnh — chỉnh thẳng ảnh bị nghiêng trước khi OCR
  • Chuyển PDF sang JPG — chuyển các trang PDF đã quét thành hình ảnh để OCR
  • Nén ảnh — giảm kích thước ảnh mà không mất độ phân giải OCR cần
  • Chuyển JPG sang PNG — chuyển sang PNG để có chất lượng không suy giảm trước khi OCR tài liệu chữ nhỏ
  • Cắt ảnh — tách vùng chứa chữ của ảnh trước khi chạy OCR

Dùng thử miễn phí — không cần đăng ký

Hầu hết công cụ chạy trong trình duyệt, nên file của bạn ở lại trên thiết bị. Một vài công cụ tải file lên máy chủ của chúng tôi và xóa đi sau khi xử lý.

Xem tất cả công cụ