tomai
लॉग इन
मुफ़्त · फ़ॉर्मैट कन्वर्टर

इमेज से टेक्स्ट (OCR)

फ़ोटो या स्क्रीनशॉट से टेक्स्ट निकालें — मुफ़्त, आपके ब्राउज़र में

11 भाषाएँ शामिल हैं। पहचान की गुणवत्ता छवि के रिज़ॉल्यूशन और स्पष्टता पर निर्भर करती है।

🔒

100% निजी — फ़ाइलें सीधे आपके ब्राउज़र में कन्वर्ट होती हैं और कभी किसी सर्वर पर अपलोड नहीं होतीं।

यह कैसे काम करता है

  1. 1

    टेक्स्ट वाली फ़ोटो या स्क्रीनशॉट ड्रॉप करें।

  2. 2

    भाषा चुनें (11 भाषाएँ शामिल — डिफ़ॉल्ट हिंदी) और एक्सट्रैक्ट पर क्लिक करें।

  3. 3

    परिणाम पेज पर पढ़ें, कॉपी करें, या .txt फ़ाइल के रूप में डाउनलोड करें।

OCR जो आपकी screenshots कभी upload नहीं करता

📄

ग्यारह OCR भाषाएँ अंतर्निर्मित

अंग्रेज़ी, सरलीकृत और पारंपरिक चीनी, जापानी, कोरियाई, जर्मन, स्पेनिश, फ़्रेंच, हिंदी, पुर्तगाली और रूसी Tesseract LSTM इंजन पर चलती हैं। चयनकर्ता आपकी भाषा पर डिफ़ॉल्ट होता है; चीनी और जापानी मिश्रित पृष्ठों के लिए अंग्रेज़ी से जुड़ी होती हैं।

छोटे स्क्रीनशॉट पहले तेज़ किए जाते हैं

लंबी भुजा में 1600 पिक्सेल से छोटी छवियाँ पहचान से पहले 2x बड़ी करके ग्रेस्केल में बदली जाती हैं — 9px का टेक्स्ट, जो इंजन को दिखता ही नहीं, प्रीप्रोसेसिंग के बाद लगभग 95% पढ़ने योग्य हो जाता है।

🔒

पाँच इमेज फ़ॉर्मेट स्वीकार्य

PNG, JPG, WebP, BMP या GIF डालें और सादा टेक्स्ट .txt पाएँ। हाशिये की खाली लाइनें हटा दी जाती हैं ताकि नतीजा सिर्फ़ निकाला गया टेक्स्ट हो।

WebAssembly में Tesseract, language packs included

  • पूरा Tesseract engine browser में WASM से चलता है — clean scans पर accuracy native build जैसी।
  • language data हर script के लिए एक बार load (eng, chi_sim, jpn…) होकर cache होती है।
  • sharp, evenly-lit, ~300DPI inputs angled photos को बुरी तरह हराते हैं।

अक्सर पूछे जाने वाले प्रश्न

क्या मेरी इमेज कहीं अपलोड होती है?

नहीं — OCR इंजन WebAssembly से पूरी तरह आपके ब्राउज़र में चलता है। इमेज डिवाइस से बाहर नहीं जाती।

कौन सी भाषाएँ समर्थित हैं?

साइट की सभी 11 भाषाएँ समर्थित हैं: अंग्रेज़ी, चीनी (सरलीकृत और पारंपरिक), जापानी, कोरियाई, जर्मन, स्पेनिश, फ्रेंच, हिंदी, पुर्तगाली और रूसी। ☁️ क्लाउड इमेज OCR टूल PDF और बैच अपलोड भी स्वीकार करता है।

टेक्स्ट क्यों नहीं निकला या गड़बड़ क्यों निकला?

OCR साफ़, उच्च-कंट्रास्ट, उचित आकार के टेक्स्ट पर सबसे अच्छा चलता है। बहुत छोटा, धुंधला, घुमा हुआ या हस्तलिखित टेक्स्ट काफ़ी कम भरोसेमंद है।

क्या फ़ाइल आकार की सीमा है?

प्रति इमेज 20 MB तक। बड़ी या ज़्यादा बारीक़ इमेज में बस थोड़ा ज़्यादा समय लगता है।

संबंधित टूल

इमेज से टेक्स्ट (OCR) टूल क्या है?

इमेज से टेक्स्ट टूल, जिसे OCR (ऑप्टिकल कैरेक्टर रिकग्निशन) टूल भी कहा जाता है, फोटो, स्क्रीनशॉट या स्कैन से शब्द पढ़कर उन्हें एडिट करने लायक सादे टेक्स्ट के रूप में लौटाता है। इमेज से टेक्स्ट हाथ से कॉपी करना धीमा और गलतियों से भरा काम है — स्क्रीनशॉट के एरर मैसेज, छपे हुए रसीद, स्कैन किए पेज और व्हाइटबोर्ड की तस्वीरें, सब टेक्स्ट को पिक्सल में कैद कर लेती हैं। यह टूल आपके ब्राउज़र पेज के अंदर ही असली OCR इंजन चलाता है: PNG, JPG, WebP, BMP या GIF डालिए, और पहचाना गया टेक्स्ट .txt फ़ाइल के रूप में वापस आ जाता है। यह उन छात्रों, शोधकर्ताओं, ऑफिस कर्मचारियों और डेवलपर्स के लिए है जिन्हें इमेज में बंद टेक्स्ट चाहिए।

मुख्य विशेषताएँ

  • ✅ PNG, JPG, WebP, BMP और GIF इमेज स्वीकार करना
  • ✅ Tesseract पर आधारित ब्राउज़र-एम्बेडेड OCR इंजन चलाना
  • ✅ पहचाने गए टेक्स्ट को सादे .txt फ़ाइल के रूप में देना
  • ✅ बिना अपलोड, बिना अकाउंट और बिना उपयोग-सीमा के काम करना
  • ✅ रिकग्निशन चलने के दौरान प्रोग्रेस दिखाना

इसका उपयोग कब करें

  • 🖥️ स्क्रीनशॉट से एरर मैसेज या कोड का टुकड़ा कॉपी करना
  • 🧾 छपे हुए रसीद, इनवॉइस या बिज़नेस कार्ड को डिजिटल बनाना
  • 📄 स्कैन किए पेज से टेक्स्ट निकालना ताकि दोबारा टाइप न करना पड़े
  • 📋 व्हाइटबोर्ड या स्लाइड की तस्वीर को एडिट करने लायक नोट्स बनाना

प्राइवेसी इसमें बिल्ट-इन है: OCR इंजन पूरी तरह आपके ब्राउज़र में चलता है और इमेज कभी डिवाइस से बाहर नहीं जाती। साइट की सभी 11 भाषाएँ शामिल हैं: अंग्रेज़ी, चीनी (सरलीकृत और पारंपरिक), जापानी, कोरियाई, जर्मन, स्पेनिश, फ्रेंच, हिंदी, पुर्तगाली और रूसी। PDF या बैच कार्यों के लिए क्लाउड इमेज OCR टूल वही इंजन सर्वर पर चलाता है। सटीकता इमेज की गुणवत्ता और साफ टाइपफेस पर निर्भर करती है; किसी भी OCR सिस्टम की तरह, हस्तलिखित और भारी स्टाइल वाले टेक्स्ट की पहचान कमज़ोर होती है।

संबंधित टूल