स्क्रीनशॉट से टेक्स्ट
किसी भी स्क्रीनशॉट से चिपकाने-योग्य टेक्स्ट — कोड, चैट, तालिकाएँ, एरर संदेश
सर्वर पर FFmpeg हर फ़ॉर्मैट सँभालता है — वे HEVC/H.265 फ़ाइलें भी जो आपका ब्राउज़र नहीं चला पाता। फ़ाइलें 30 मिनट में सर्वर से हट जाती हैं।
⚠️ काम पूरा होने तक यह पेज बंद या रिफ़्रेश न करें, वरना नतीजा खो सकता है।
💡 बड़ी फ़ाइलें आपके कनेक्शन की रफ़्तार से सफ़र करती हैं: अपलोड ख़ुद-ब-ख़ुद आगे बढ़ता है और सुरक्षित रूप से resume होता है, इसलिए धीमा नेटवर्क सिर्फ़ समय पर असर डालता है — आपके क्रेडिट्स पर कभी नहीं।
रिकग्निशन पाइपलाइन कैसे काम करती है
दोनों मोड एक ही सर्वर-साइड OCR इंजन साझा करते हैं, जिसे अलग-अलग तरीके से पहले से ट्यून किया गया है:
- फ़ोटो मोड — टेढ़े पेजों को सीधा करता है और रिकग्निशन से पहले एक्सपोज़र को सामान्य करता है; दस्तावेज़ों, साइनबोर्ड और हस्तलिखित पाठ के प्रयासों के लिए सबसे उपयुक्त।
- स्क्रीनशॉट मोड — इंटरफ़ेस टेक्स्ट में अक्षरों की दूरी बनाए रखता है: चैट बबल, मेनू, टर्मिनल आउटपुट और पिक्सेल फ़ॉन्ट वहीं सुरक्षित रहते हैं जहाँ सामान्य OCR उन्हें धुंधला कर देता है।
- भाषाएँ — Tesseract के ज़रिए 100+ भाषाएँ, स्वचालित स्क्रिप्ट पहचान के साथ; चीनी-अंग्रेज़ी मिश्रित कैप्चर प्रति लाइन संभाले जाते हैं।
- आउटपुट — रीडिंग ऑर्डर बनाए रखने वाला प्लेन टेक्स्ट, साथ ही कम निश्चितता वाले शब्दों पर कॉन्फ़िडेंस मार्कर, जिन्हें आपको दोबारा जाँचना चाहिए।
दो OCR इंजन, एक ही वर्कस्पेस
फ़ोटो मोड कैमरे से ली गई तस्वीरों को पर्सपेक्टिव करेक्शन के साथ पढ़ता है; स्क्रीनशॉट मोड चैट UI, कोड और गेम टेक्स्ट के लिए ट्यून किया गया है — पेज छोड़े बिना हर काम के अनुसार चुनें।
दो पहचान मोड
सामान्य इमेज OCR और स्क्रीनशॉट-केंद्रित OCR एक ही उपकरण में।
बहु-भाषा समर्थन
इंजन सभी ग्यारह साइट भाषाओं में पाठ की पहचान करता है।
11 भाषाएँ पढ़ता है
प्रोसेसिंग के बाद अपलोड की गई छवियाँ सर्वर से हटा दी जाती हैं।
कॉन्फ़िडेंस फ़्लैग
कम निश्चितता वाले शब्दों को चिह्नित किया जाता है ताकि आप आँख बंद करके आउटपुट पर भरोसा करने के बजाय ठीक-ठीक जान सकें कि किन जगहों की दोबारा जाँच करनी है।
यह कैसे काम करता है
- 1
इमेज या स्क्रीनशॉट मोड चुनें।
- 2
पाठ युक्त चित्र अपलोड करें।
- 3
पहचाने गए पाठ को कॉपी या डाउनलोड करें।
- 4
पहचाने गए टेक्स्ट को इनलाइन कॉपी करें या UTF-8 TXT के रूप में डाउनलोड करें।
अक्सर पूछे जाने वाले प्रश्न
क्या मैं एक PDF का OCR कर सकता हूँ?⌄
हाँ, दोनों मोड PDF पृष्ठों को इनपुट के रूप में स्वीकार करते हैं।
क्या यह हस्तलिखित लेखन का समर्थन करता है?⌄
यह मुद्रित पाठ पर सबसे अच्छा काम करता है। हस्तलिखित पाठ की पहचान की गारंटी नहीं है।
क्या मेरी छवि संग्रहित रखी जाती है?⌄
नहीं। टेक्स्ट निकालने के बाद सर्वर से इसे हटा दिया जाता है।
हस्तलिखित टेक्स्ट अक्सर क्यों नहीं पढ़ा जा पाता?⌄
इंजन मुद्रित टेक्स्ट के लिए बना है। साफ़ ब्लॉक लेटर कभी-कभी काम कर जाते हैं; कर्सिव हस्तलेखन के लिए एक समर्पित हैंडराइटिंग मॉडल चाहिए, जिसे रखने का दिखावा यह टूल जानबूझकर नहीं करता।
संबंधित टूल
इमेज OCR क्या है?
इमेज OCR टेक्स्ट की तस्वीरों को संपादित करने योग्य, चुनने योग्य पाठ में बदल देता है। यह स्कैन किए गए दस्तावेज़ों, पृष्ठों की तस्वीरों और ऐप्स या चैट वार्तालाप के स्क्रीनशॉट्स पर काम करता है।
आप क्या कर सकते हैं
- फ़ोटो और स्कैन से पाठ निकालना
- स्क्रीनशॉट्स और चैट विंडोज़ में पाठ की पहचान करना
- एक ही इंजन के साथ कई भाषाओं को प्रोसेस करना
इसका उपयोग कब करें
- मुद्रित नोट्स या रसीदों को डिजिटल करना
- ऐसी छवियों से पाठ कॉपी करना जिन्हें आप चुन नहीं सकते
- स्क्रीनशॉट्स को संपादित करने योग्य सामग्री में बदलना
छवियाँ सर्वर-साइड पहचान के लिए अपलोड की जाती हैं और फिर हटा दी जाती हैं।