Menu
Lahat ng post

Larawan sa Teksto: Kunin ang Teksto sa Anumang Larawan nang Libre (OCR Online)

9 min na basahinLibre · Walang signup

Kailangan mo bang kunin ang mga salita mula sa isang larawan? Resibong na-scan man ito, litrato ng whiteboard, screenshot ng dokumento, o larawan ng karatula, ginagawang totoong teksto ng OCR (Optical Character Recognition) ang mga pixel ng larawan para ma-copy, ma-edit, at mahanap mo. Ipinapaliwanag ng gabay na ito kung paano gamitin ang libreng Larawan sa Teksto (OCR) na tool sa site na ito. Tumatakbo ang pagkilala sa aming server: ipinapadala ang file mo sa pamamagitan ng naka-encrypt na koneksyon at buburahin agad kapag nakuha na ang teksto.


Ano ang OCR?

Ang OCR ay nangangahulugang Optical Character Recognition. Ito ang teknolohiyang sumusuri sa isang larawan at kumikilala sa hugis ng mga letra, numero, at bantas para makabuo ng tekstong nababasa ng makina.

Gumagamit ang mga makabagong OCR engine ng mga neural network na sinanay sa milyon-milyong nakalimbag at sulat-kamay na karakter. Nakakakilala sila ng teksto sa iba't ibang font, laki, wika, at kondisyon ng larawan, kahit bahagyang nakahilig o medyo malabo.

Dahil sa OCR:

  • Nade-digitize ng mga bangko ang mga tseke at ID
  • Naii-index ng Google Search ang teksto sa loob ng mga larawan
  • Nababasa ng mga serbisyo ng koreo ang mga sulat-kamay na address sa sobre
  • Napapahanap ng mga archivist ang milyon-milyong na-scan na libro

Ang parehong teknolohiya ay libre ritong magagamit.


Paano Kunin ang Teksto sa Larawan, Hakbang-hakbang

Pinapatakbo ng Larawan sa Teksto (OCR) na tool ang Tesseract OCR sa aming server. Ina-upload ang larawan mo sa pamamagitan ng naka-encrypt na HTTPS na koneksyon, kinukuha ang teksto, at binubura ang na-upload na file mula sa server pagkatapos.

Hakbang 1: Buksan ang Larawan sa Teksto (OCR) na tool

Pumunta sa want2convert.com/image-to-text. Makikita mo ang isang simpleng upload zone at isang language selector.

Hakbang 2: I-upload ang larawan mo

I-drag and drop ang larawan sa upload zone o mag-click para mag-browse sa device mo. Ang mga suportadong format ay JPG, PNG, TIFF, BMP, WebP, at PDF, hanggang 50 MB. Para sa mga na-scan na dokumento, gamitin ang pinakamataas na resolusyon ng scan na available: 300 DPI o mas mataas ang nagbibigay ng pinakamagandang resulta.

Hakbang 3: Piliin ang wika (kung kailangan)

Bilang default, English ang nakikilala ng engine. Sinusuportahan din ng tool ang Swahili (Kiswahili), French, at Arabic: piliin sa dropdown ang wika ng teksto sa larawan mo bago kunin ang teksto. Ang paggamit ng tamang language model ay malaki ang naitutulong sa katumpakan para sa mga karakter na may accent at mga letter pattern na partikular sa wika. Hindi pa sinusuportahan sa ngayon ang iba pang wika.

Hakbang 4: I-click ang “Kunin ang Teksto”

I-click ang button. Ipinapadala ang file mo sa aming server, kung saan pinalalaki ito at kino-convert sa greyscale para gumanda ang pagkilala, at saka binabasa ng Tesseract. Karaniwang ilang segundo lang ang pagproseso, depende sa laki ng larawan at dami ng teksto; nagta-time out ang mga request pagkalipas ng mga dalawang minuto.

Hakbang 5: I-copy o i-download ang resulta

Lalabas ang nakuhang teksto sa isang text area. Puwede mong:

  • I-copy sa Clipboard — i-paste nang direkta sa Word, Google Docs, o anumang text editor
  • I-download ang .txt — i-save ang resulta bilang .txt na file

Ano ang Gumagawa ng Magandang Source na Larawan para sa OCR

Malaki ang epekto ng kalidad ng input na larawan sa katumpakan ng OCR. Ito ang mga pinakamalaki ang naidudulot na pagkakaiba:

Resolusyon: Kailangan ng sapat na pixel ang teksto para mabasa. Karaniwang maayos ang mga litrato ng dokumento mula sa cellphone na kinunan sa magandang ilaw at sa makatwirang layo (30–50 cm). Ang praktikal na pinakamababang resolusyon para sa malinaw na maliliit na letra ay mga 150–200 DPI; ang 300 DPI ang pamantayan ng OCR para sa archival scanning.

Contrast: Ang madilim na teksto sa maliwanag na background ang nagbibigay sa engine ng pinakamalinaw na signal. Binabawasan ng kumupas na tinta, mapusyaw na abong teksto sa puting papel, o may kulay na teksto sa background na may disenyo ang katumpakan.

Linaw: Ang mga malabong larawan, dahil sa nanginig na camera o problema sa focus, ang pinakamalaking sanhi ng mga error sa OCR. Gumamit ng matatag na ibabaw kapag kumukuha ng litrato ng dokumento. Mahusay ang macro mode ng cellphone para sa mga dokumentong maliliit ang letra.

Oryentasyon: Binabawasan ng sobrang hilig o nakaikot na teksto ang katumpakan. Kaya ng OCR engine ang bahagyang tabingi (ilang digri), pero mas mahina ang resulta ng mga pahinang kinunan sa matarik na anggulo. Kung kailangan, gamitin muna ang Paikutin ang Larawan na tool para maitayo nang tama ang litrato mo.

Ingay at anino: Binabawasan ng mga lukot, anino sa pahina, at texture ng background ang katumpakan. Kunan ng litrato ang mga dokumento nang patag sa isang mapusyaw na mesa at pantay ang ilaw.


Katumpakan: Ano ang Kaya at Hindi Kaya ng OCR

Napakatumpak ng OCR sa malilinis, mataas ang contrast, at nakalimbag na dokumento, madalas na 99%+ ang katumpakan ng karakter sa magandang input. Pero may totoong limitasyon ang teknolohiya na dapat mong maintindihan:

| Uri ng input | Inaasahang katumpakan | |------------|------------------| | Malinis na na-scan na nakalimbag na dokumento (300 DPI) | 98–99%+ | | Malinaw na litrato mula sa cellphone ng nakalimbag na teksto | 90–97% | | Kupas o mababa ang contrast na print | 70–85% | | Sulat-kamay (maayos, pare-pareho) | 60–80% | | Sulat-kamay (cursive, iba-iba) | 40–65% | | Sobrang istilong font o logo | 30–60% | | Teksto sa larawang maraming ingay/background | 50–75% |

Para sa nakalimbag na teksto sa magandang kondisyon, asahan ang halos perpektong resulta. Laging suriin ang output: ang isang maling karakter sa numero o pangalan ay may tunay na epekto.


Mga Karaniwang Gamit ng Larawan sa Teksto

Mga Na-scan na Dokumento at PDF

Marami pa ring papel sa mga opisina. Kapag nakatanggap ka ng na-scan na kontrata, form, o liham bilang PDF o larawan, ginagawa ito ng OCR na dokumentong mahahanap at puwedeng i-edit. Pagkatapos makuha ang teksto, i-paste ito sa Word o Google Docs para i-edit, o i-save bilang file na mahahanap mo gamit ang Ctrl+F.

Mga Resibo at Invoice

Karaniwang paraan ang pagkuha ng litrato ng mga resibo para masubaybayan ang gastos. Kinukuha ng OCR ang mga line item, kabuuan, at pangalan ng tindahan para direkta mong mai-paste sa spreadsheet o expense report nang hindi na nagta-type ulit.

Mga Business Card

Ang mabilis na litrato ng business card mula sa cellphone, kapag dumaan sa OCR, ay nagbibigay ng pangalan, titulo, numero ng telepono, email, at kumpanya ng contact, handa nang i-copy sa contacts app mo.

Mga Screenshot ng Artikulo at Web Page

Kung kailangan mong mag-quote mula sa screenshot o mag-copy ng teksto mula sa PDF na gawa sa mga larawan (na-scan na libro, PDF na hindi mapipili ang teksto), kinukuha ito ng OCR bilang totoong tekstong magagamit mo.

Mga Litrato ng Whiteboard

Pagkatapos ng meeting, madalas na nakatengga lang sa camera roll ang mga litrato ng whiteboard notes. Ginagawa itong text file o mahahanap na notes ng OCR.

Pag-digitize ng Libro at Archive

Gumagamit ng OCR ang mga mananaliksik at genealogist na nag-i-scan ng mga lumang libro, pahayagan, at makasaysayang tala para mapahanap ang mga archive na iyon. Ang Tesseract, ang open-source na engine na ginagamit dito, ay malawakang ginagamit sa mga proyekto ng archival digitisation.

Daloy ng Pagsasalin

Kunin muna ang teksto mula sa larawan, saka i-paste sa isang translation tool. Mas mabilis ito kaysa manu-manong mag-type ng teksto mula sa litrato ng dayuhang dokumento, menu, o karatula.


OCR vs Copy-Paste: Kailan Gagamitin ang Alin

Kung digital na PDF ang gamit mo na may text layer, mas mabilis at mas tumpak ang Ctrl+A + Ctrl+C (piliin lahat, i-copy) kaysa OCR. Gamitin ang OCR kapag:

  • Ang PDF ay na-scan na larawan (walang text layer)
  • Ang source ay litrato o screenshot
  • Hindi pinapayagan ng dokumento ang pagpili ng teksto (mga naka-lock na PDF, bagaman baka gusto mo ring i-unlock muna)
  • Ang teksto ay nasa pisikal na dokumento, karatula, o whiteboard

Mga Madalas Itanong

Talaga bang libre ang OCR tool?
Oo, ganap na libre. Walang account, walang subscription, walang watermark sa output.

Ligtas ba ang mga larawan ko?
Ipinapadala ang larawan o PDF mo sa aming server sa pamamagitan ng naka-encrypt (HTTPS) na koneksyon, pinoproseso doon gamit ang Tesseract OCR, at binubura agad kapag nakuha na ang teksto. Hindi kami nagtatago ng kopya at hindi kailangan ng account. Dahil sa server pinoproseso ang file, iwasang mag-upload ng mga dokumentong hindi ka komportableng ipadala sa internet.

Anong mga wika ang sinusuportahan?
Ang English ang default. Puwede mo ring piliin ang Swahili (Kiswahili), French, o Arabic mula sa language selector. Hindi pa sinusuportahan sa ngayon ang iba pang wika.

Gaano ito katumpak?
Para sa malinis na nakalimbag na teksto na may sapat na resolusyon, karaniwang napakataas ng katumpakan. Para sa sulat-kamay o mababang kalidad na larawan, mas mababa ito. Laging suriin ang output para sa mahahalagang dokumento.

Nababasa ba nito ang sulat-kamay?
Limitado ang kakayahan ng OCR na kumilala ng sulat-kamay. Pinakamahusay ito sa nakalimbag na teksto, at maaaring pangit ang resulta ng mga sulat-kamay na tala, lalo na ang cursive.

Ano ang pinakamalaking laki ng larawan?
Limitado sa 50 MB ang mga upload, at nagta-time out ang mga request pagkalipas ng mga dalawang minuto. Maaaring mabagal ang napakalalaking larawan; ang pagliit sa 2000–3000 pixel ang lapad gamit ang I-resize ang Larawan na tool bago ang OCR ay madalas nagpapabilis nang hindi nababawasan ang katumpakan.

Puwede ba akong kumuha ng teksto mula sa PDF?
Oo, puwede kang direktang mag-upload ng PDF; nire-render at binabasa nang isa-isa ang mga pahina nito. Kung malaki ang PDF o gusto mo ng mas maraming kontrol, puwede mo ring i-save muna ang mga pahina bilang JPG o PNG gamit ang PDF sa JPG na tool at patakbuhin ang OCR sa mga larawan.

Bakit mali ang ilang karakter?
Kadalasang galing sa mababang resolusyon, labo, mababang contrast, o kakaibang font ang mga error sa OCR. Subukang pagandahin ang kalidad ng input na larawan at patakbuhin ulit. Para sa mga paulit-ulit na error (halimbawa, ang l na nababasa bilang 1), manu-manong ayusin ang output pagkatapos kunin ang teksto.


Mga Kaugnay na Tool

  • I-resize ang Larawan — palakihin ang maliit na larawan bago ang OCR para gumanda ang katumpakan
  • Paikutin ang Larawan — ituwid ang nakahilig na litrato bago ang OCR
  • PDF sa JPG — gawing mga larawan ang mga pahina ng na-scan na PDF para sa OCR
  • I-compress ang Larawan — paliitin ang laki ng larawan nang hindi nawawala ang resolusyong kailangan ng OCR
  • JPG sa PNG — i-convert sa PNG para sa lossless na kalidad bago ang OCR sa mga dokumentong maliliit ang letra
  • I-crop ang Larawan — ihiwalay ang bahaging may teksto ng litrato bago patakbuhin ang OCR

Subukan nang libre — hindi kailangan ng signup

Karamihan ng tool ay tumatakbo sa browser mo, kaya nananatili ang mga file sa device mo. Ang ilan ay nag-a-upload ng file sa server namin at binubura ito pagkatapos.

Tingnan ang lahat ng tool