मेन्यू
सभी पोस्ट

इमेज से टेक्स्ट: किसी भी फ़ोटो से टेक्स्ट निकालें, मुफ़्त (ऑनलाइन OCR)

9 मिनट में पढ़ेंमुफ़्त · बिना साइन-अप

क्या आपको किसी फ़ोटो में लिखे शब्द निकालने हैं? चाहे वह स्कैन की हुई रसीद हो, व्हाइटबोर्ड की तस्वीर, किसी दस्तावेज़ का स्क्रीनशॉट या किसी साइनबोर्ड की फ़ोटो, OCR (Optical Character Recognition, यानी ऑप्टिकल कैरेक्टर रिकग्निशन) इमेज के पिक्सल को असली टेक्स्ट में बदल देता है, जिसे आप कॉपी, एडिट और सर्च कर सकते हैं। यह गाइड बताती है कि इस साइट के मुफ़्त इमेज से टेक्स्ट (OCR) टूल का इस्तेमाल कैसे करें। पहचान का काम हमारे सर्वर पर होता है: आपकी फ़ाइल एन्क्रिप्टेड कनेक्शन से भेजी जाती है और टेक्स्ट निकलते ही हटा दी जाती है।


OCR क्या है?

OCR का पूरा नाम Optical Character Recognition है। यह वह तकनीक है जो किसी इमेज का विश्लेषण करके अक्षरों, अंकों और विराम-चिह्नों के आकार पहचानती है और मशीन से पढ़ा जा सकने वाला टेक्स्ट बनाती है।

आधुनिक OCR इंजन न्यूरल नेटवर्क का इस्तेमाल करते हैं, जिन्हें लाखों छपे और हाथ से लिखे अक्षरों पर प्रशिक्षित किया गया है। वे अलग-अलग फ़ॉन्ट, आकार, भाषाओं और इमेज की स्थितियों में टेक्स्ट पहचान सकते हैं, यहाँ तक कि हल्के झुकाव या थोड़ी धुंधली इमेज में भी।

OCR की वजह से ही:

  • बैंक चेक और पहचान-पत्रों को डिजिटल बना पाते हैं
  • Google Search इमेज के अंदर लिखे टेक्स्ट को इंडेक्स कर पाता है
  • डाक सेवाएँ लिफ़ाफ़ों पर हाथ से लिखे पते पढ़ पाती हैं
  • अभिलेखागार के लोग लाखों स्कैन की गई किताबों को सर्च करने लायक बना पाते हैं

वही तकनीक यहाँ मुफ़्त में उपलब्ध है।


इमेज से टेक्स्ट कैसे निकालें: चरण दर चरण

इमेज से टेक्स्ट (OCR) टूल हमारे सर्वर पर Tesseract OCR चलाता है। आपकी इमेज एन्क्रिप्टेड HTTPS कनेक्शन से अपलोड होती है, टेक्स्ट निकाला जाता है और उसके बाद अपलोड की गई फ़ाइल सर्वर से हटा दी जाती है।

चरण 1: इमेज से टेक्स्ट (OCR) टूल खोलें

want2convert.com/image-to-text पर जाएँ। आपको एक सादा अपलोड ज़ोन और भाषा चुनने का विकल्प दिखेगा।

चरण 2: अपनी इमेज अपलोड करें

अपनी इमेज को अपलोड ज़ोन में खींचकर छोड़ें या अपने डिवाइस से चुनने के लिए क्लिक करें। समर्थित फ़ॉर्मैट JPG, PNG, TIFF, BMP, WebP और PDF हैं, 50 MB तक। स्कैन किए दस्तावेज़ों के लिए उपलब्ध सबसे ऊँचे रेज़ोल्यूशन का स्कैन इस्तेमाल करें: 300 DPI या उससे ज़्यादा पर सबसे अच्छे नतीजे मिलते हैं।

चरण 3: भाषा चुनें (ज़रूरत हो तो)

डिफ़ॉल्ट रूप से इंजन अंग्रेज़ी पहचानता है। यह टूल स्वाहिली (किस्वाहिली), फ़्रेंच और अरबी भी समर्थित करता है: टेक्स्ट निकालने से पहले ड्रॉपडाउन से अपनी इमेज में मौजूद टेक्स्ट की भाषा चुनें। सही भाषा मॉडल इस्तेमाल करने से एक्सेंट वाले अक्षरों और भाषा-विशेष अक्षर-पैटर्न में सटीकता काफ़ी बढ़ जाती है। अन्य भाषाएँ फ़िलहाल समर्थित नहीं हैं।

चरण 4: “टेक्स्ट निकालें” पर क्लिक करें

बटन पर क्लिक करें। आपकी फ़ाइल हमारे सर्वर पर भेजी जाती है, जहाँ पहचान बेहतर करने के लिए उसे बड़ा किया जाता है और ग्रेस्केल में बदला जाता है, फिर Tesseract उसे पढ़ता है। प्रोसेसिंग में आमतौर पर कुछ सेकंड लगते हैं, जो इमेज के आकार और टेक्स्ट की घनता पर निर्भर करता है; अनुरोध लगभग दो मिनट बाद टाइम-आउट हो जाते हैं।

चरण 5: नतीजा कॉपी या डाउनलोड करें

निकाला गया टेक्स्ट एक टेक्स्ट एरिया में दिखता है। आप ये कर सकते हैं:

  • क्लिपबोर्ड पर कॉपी करें — सीधे Word, Google Docs या किसी भी टेक्स्ट एडिटर में पेस्ट करें
  • .txt डाउनलोड करें — नतीजे को .txt फ़ाइल के रूप में सेव करें

OCR के लिए अच्छी सोर्स इमेज कैसी होती है

OCR की सटीकता इनपुट इमेज की गुणवत्ता पर बहुत निर्भर करती है। सबसे ज़्यादा फ़र्क़ ये बातें डालती हैं:

रेज़ोल्यूशन: टेक्स्ट पढ़ने लायक रहे, इसके लिए पर्याप्त पिक्सल चाहिए। अच्छी रोशनी में और ठीक दूरी (30–50 सेमी) से मोबाइल से खींची गई दस्तावेज़ों की फ़ोटो आमतौर पर अच्छी रहती हैं। साफ़ छोटे अक्षरों के लिए व्यावहारिक न्यूनतम रेज़ोल्यूशन लगभग 150–200 DPI है; आर्काइवल स्कैनिंग के लिए 300 DPI OCR का मानक है।

कंट्रास्ट: हल्की पृष्ठभूमि पर गहरा टेक्स्ट इंजन को सबसे साफ़ संकेत देता है। फीकी स्याही, सफ़ेद काग़ज़ पर हल्का स्लेटी टेक्स्ट, या डिज़ाइन वाली पृष्ठभूमि पर रंगीन टेक्स्ट सटीकता घटा देते हैं।

साफ़-धार (शार्पनेस): धुंधली इमेज, कैमरा हिलने या फ़ोकस की समस्या से, OCR की गलतियों की सबसे बड़ी वजह होती हैं। दस्तावेज़ों की फ़ोटो लेते समय फ़ोन को किसी स्थिर सतह पर रखें। छोटे अक्षरों वाले दस्तावेज़ों के लिए फ़ोन का मैक्रो मोड अच्छा काम करता है।

ओरिएंटेशन: बहुत ज़्यादा झुका या घूमा हुआ टेक्स्ट सटीकता घटाता है। OCR इंजन थोड़ा-सा झुकाव (कुछ डिग्री) संभाल सकता है, पर तीखे कोण से खींचे गए पन्ने खराब नतीजे देते हैं। ज़रूरत हो तो पहले इमेज घुमाएं टूल से अपनी फ़ोटो को सही दिशा में घुमा लें।

शोर और परछाइयाँ: सिलवटें, पन्ने पर पड़ती परछाइयाँ और पृष्ठभूमि की बनावट सटीकता घटाती हैं। दस्तावेज़ों को हल्के रंग की मेज़ पर सपाट रखकर, एक-सी रोशनी में खींचें।


सटीकता: OCR क्या कर सकता है और क्या नहीं

साफ़, ऊँचे कंट्रास्ट वाले छपे दस्तावेज़ों पर OCR बहुत सटीक होता है, अच्छे इनपुट पर अक्सर 99%+ अक्षर सही। फिर भी इस तकनीक की कुछ असली सीमाएँ हैं जिन्हें समझना ज़रूरी है:

| इनपुट का प्रकार | अपेक्षित सटीकता | |------------|------------------| | साफ़ स्कैन किया हुआ छपा दस्तावेज़ (300 DPI) | 98–99%+ | | छपे टेक्स्ट की साफ़ फ़ोन फ़ोटो | 90–97% | | फीकी या कम कंट्रास्ट वाली छपाई | 70–85% | | हस्तलिखित (सुघड़, एक-सी) | 60–80% | | हस्तलिखित (घसीट, बदलती शैली) | 40–65% | | बहुत सजावटी फ़ॉन्ट या लोगो | 30–60% | | बहुत शोर या पृष्ठभूमि वाली इमेज में टेक्स्ट | 50–75% |

अच्छी स्थितियों में छपे टेक्स्ट पर लगभग बिल्कुल सही नतीजे की उम्मीद करें। आउटपुट हमेशा दोबारा पढ़ लें: किसी संख्या या नाम में एक अक्षर की गलती भी असली नुक़सान कर सकती है।


इमेज से टेक्स्ट के आम इस्तेमाल

स्कैन किए दस्तावेज़ और PDF

दफ़्तरों में आज भी काग़ज़ों के ढेर लगे रहते हैं। जब आपको स्कैन किया हुआ अनुबंध, फ़ॉर्म या पत्र PDF या इमेज के रूप में मिलता है, तो OCR उसे सर्च और एडिट होने लायक दस्तावेज़ में बदल देता है। टेक्स्ट निकालने के बाद उसे एडिट करने के लिए Word या Google Docs में पेस्ट करें, या ऐसी फ़ाइल के रूप में सेव करें जिसमें आप Ctrl+F से खोज सकें।

रसीदें और इनवॉइस

ख़र्च का हिसाब रखने के लिए रसीदों की फ़ोटो खींचना आम तरीका है। OCR आइटम, कुल रकम और विक्रेता के नाम निकाल देता है, ताकि आप उन्हें दोबारा टाइप किए बिना सीधे स्प्रेडशीट या ख़र्च रिपोर्ट में पेस्ट कर सकें।

विज़िटिंग कार्ड

विज़िटिंग कार्ड की फ़ोन से खींची तेज़ फ़ोटो को OCR से गुज़ारने पर आपको संपर्क का नाम, पद, फ़ोन नंबर, ईमेल और कंपनी मिल जाती है, जो आपके कॉन्टैक्ट ऐप में कॉपी करने के लिए तैयार होती है।

लेखों और वेब पेजों के स्क्रीनशॉट

अगर आपको किसी स्क्रीनशॉट से उद्धरण लेना है या इमेज-आधारित PDF (स्कैन की गई किताब, ऐसा PDF जिसका टेक्स्ट चुना नहीं जा सकता) से टेक्स्ट कॉपी करना है, तो OCR उसे असली टेक्स्ट के रूप में निकाल देता है जिसे आप इस्तेमाल कर सकते हैं।

व्हाइटबोर्ड की फ़ोटो

मीटिंग के बाद व्हाइटबोर्ड के नोट्स की फ़ोटो अक्सर कैमरा रोल में पड़ी रह जाती हैं और उन पर कुछ नहीं होता। OCR उन्हें टेक्स्ट फ़ाइलों या सर्च किए जा सकने वाले नोट्स में बदल देता है।

किताबों और अभिलेखों का डिजिटलीकरण

पुरानी किताबें, अख़बार और ऐतिहासिक रिकॉर्ड स्कैन करने वाले शोधकर्ता और वंशावली खोजने वाले इन अभिलेखों को सर्च करने लायक बनाने के लिए OCR का इस्तेमाल करते हैं। यहाँ इस्तेमाल होने वाला ओपन-सोर्स इंजन Tesseract अभिलेखागार के डिजिटलीकरण प्रोजेक्ट्स में बड़े पैमाने पर इस्तेमाल होता है।

अनुवाद का तरीका

पहले इमेज से टेक्स्ट निकालें, फिर उसे किसी अनुवाद टूल में पेस्ट करें। किसी विदेशी भाषा के दस्तावेज़, मेन्यू या साइन की फ़ोटो से टेक्स्ट हाथ से दोबारा टाइप करने की तुलना में यह कहीं ज़्यादा तेज़ है।


OCR बनाम कॉपी-पेस्ट: कब क्या इस्तेमाल करें

अगर आप ऐसे डिजिटल PDF के साथ काम कर रहे हैं जिसमें टेक्स्ट लेयर मौजूद है, तो Ctrl+A + Ctrl+C (सब चुनें, कॉपी करें) OCR से तेज़ और ज़्यादा सटीक है। OCR तब इस्तेमाल करें जब:

  • PDF स्कैन की गई इमेज हो (टेक्स्ट लेयर न हो)
  • सोर्स कोई फ़ोटो या स्क्रीनशॉट हो
  • दस्तावेज़ में टेक्स्ट चुनने की अनुमति न हो (लॉक किए गए PDF, हालाँकि हो सकता है आप पहले उसे अनलॉक भी करना चाहें)
  • टेक्स्ट किसी भौतिक दस्तावेज़, साइन या व्हाइटबोर्ड पर हो

अक्सर पूछे जाने वाले सवाल

क्या OCR टूल सचमुच मुफ़्त है?
हाँ, पूरी तरह मुफ़्त। न अकाउंट, न सब्सक्रिप्शन, और आउटपुट पर कोई वॉटरमार्क नहीं।

क्या मेरी इमेज सुरक्षित हैं?
आपकी इमेज या PDF एन्क्रिप्टेड (HTTPS) कनेक्शन से हमारे सर्वर पर भेजी जाती है, वहाँ Tesseract OCR से प्रोसेस होती है, और टेक्स्ट निकलते ही हटा दी जाती है। हम कोई कॉपी नहीं रखते और अकाउंट की ज़रूरत नहीं है। चूँकि फ़ाइल सर्वर पर प्रोसेस होती है, ऐसे दस्तावेज़ अपलोड न करें जिन्हें इंटरनेट पर भेजना आपको ठीक न लगे।

यह कौन-सी भाषाएँ समर्थित करता है?
अंग्रेज़ी डिफ़ॉल्ट है। आप भाषा चुनने वाले विकल्प से स्वाहिली (किस्वाहिली), फ़्रेंच या अरबी भी चुन सकते हैं। अन्य भाषाएँ फ़िलहाल समर्थित नहीं हैं।

यह कितना सटीक है?
पर्याप्त रेज़ोल्यूशन वाले साफ़ छपे टेक्स्ट के लिए सटीकता आमतौर पर बहुत ऊँची होती है। हस्तलिखित या खराब गुणवत्ता वाली इमेज के लिए यह कम होती है। ज़रूरी दस्तावेज़ों में आउटपुट हमेशा दोबारा पढ़ें।

क्या यह हस्तलिखित टेक्स्ट पढ़ सकता है?
OCR की हस्तलिपि पहचानने की क्षमता सीमित है। यह छपे टेक्स्ट पर सबसे अच्छा चलता है, और हाथ से लिखे नोट्स ख़राब नतीजे दे सकते हैं, ख़ासकर घसीट लिखावट में।

इमेज का अधिकतम आकार क्या है?
अपलोड 50 MB तक सीमित हैं, और अनुरोध लगभग दो मिनट बाद टाइम-आउट हो जाते हैं। बहुत बड़ी इमेज धीमी हो सकती हैं; OCR से पहले इमेज का साइज़ बदलें टूल से उन्हें 2000–3000 पिक्सल चौड़ाई तक घटाने से अक्सर सटीकता घटे बिना काम तेज़ हो जाता है।

क्या मैं PDF से टेक्स्ट निकाल सकता हूँ?
हाँ, आप सीधे PDF अपलोड कर सकते हैं; उसके पन्ने रेंडर होकर एक-एक करके पढ़े जाते हैं। अगर PDF बड़ा है या आप ज़्यादा नियंत्रण चाहते हैं, तो आप पहले PDF से JPG टूल से पन्नों को JPG या PNG के रूप में सेव करके इमेज पर OCR चला सकते हैं।

कुछ अक्षर गलत क्यों आते हैं?
OCR की गलतियाँ ज़्यादातर कम रेज़ोल्यूशन, धुंधलेपन, कम कंट्रास्ट या असामान्य फ़ॉन्ट से आती हैं। इनपुट इमेज की गुणवत्ता सुधारकर दोबारा चलाएँ। बार-बार होने वाली गलतियों (जैसे l का 1 पढ़ा जाना) के लिए टेक्स्ट निकलने के बाद आउटपुट हाथ से ठीक कर लें।


संबंधित टूल

  • इमेज का साइज़ बदलें — सटीकता बढ़ाने के लिए OCR से पहले छोटी इमेज को बड़ा करें
  • इमेज घुमाएं — OCR से पहले झुकी हुई फ़ोटो सीधी करें
  • PDF से JPG — OCR के लिए स्कैन किए PDF के पन्नों को इमेज में बदलें
  • इमेज कंप्रेस करें — OCR को जो रेज़ोल्यूशन चाहिए उसे खोए बिना इमेज का आकार घटाएँ
  • JPG से PNG — छोटे अक्षरों वाले दस्तावेज़ों पर OCR से पहले बिना गुणवत्ता खोए PNG में बदलें
  • फ़ोटो क्रॉप करें — OCR चलाने से पहले फ़ोटो का टेक्स्ट वाला हिस्सा अलग करें

मुफ़्त में आज़माएं — साइन-अप की ज़रूरत नहीं

ज़्यादातर टूल्स आपके ब्राउज़र में चलते हैं, इसलिए आपकी फ़ाइलें आपके डिवाइस पर ही रहती हैं। कुछ टूल्स फ़ाइल को हमारे सर्वर पर अपलोड करते हैं और बाद में उसे डिलीट कर देते हैं।

सभी टूल्स देखें