किसी सर्वर पर आपकी फ़ाइल की सामग्री की कोई प्रोसेसिंग नहीं होती। गोपनीय या व्यावसायिक दस्तावेज़ संभालने के लिए आपको gottrix के साथ किसी डेटा-प्रोसेसिंग समझौते की ज़रूरत नहीं।
Hosted in GermanyGlobal Content Delivery
ओरिजिन सर्वर जर्मनी में Hetzner पर हैं, और कंटेंट डिलीवरी नेटवर्क (CDN) के ज़रिए दुनिया भर में डिलीवरी होती है। इस दौरान आपकी फ़ाइल की सामग्री कभी ट्रांसमिट नहीं होती - वह आपके डिवाइस से बाहर नहीं जाती।
OCR (ऑप्टिकल कैरेक्टर रिकग्निशन) टेक्स्ट वाली छवि को वास्तविक, चुने जाने योग्य टेक्स्ट में बदल देता है। आप किसी चालान, पत्र या किताब के पन्ने की फोटो खींचें या स्कैन करें और उसकी सामग्री TXT फ़ाइल के रूप में पाएं जिसे खोजा, कॉपी और आगे उपयोग किया जा सकता है। पहचान के लिए ओपन-सोर्स Tesseract इंजन का उपयोग होता है, जो यहां पूरी तरह ब्राउज़र में WebAssembly के रूप में चलता है - इस साइट के अन्य टूल्स जैसा ही तरीका।
सूची से दस्तावेज़ की भाषा चुनें - 100 से अधिक भाषाएं उपलब्ध हैं, हिंदी, अंग्रेज़ी और यूरोपीय भाषाओं से लेकर रूसी, अरबी, हिब्रू, जापानी, कोरियाई और चीनी तक। हर भाषा अपने नाम से दिखाई देती है ताकि आप उसे तुरंत पहचान सकें। सही विकल्प चुनने से उस लिपि के अक्षर, मात्राएं और विशेष चिह्न सही ढंग से पहचाने जाते हैं। पहली बार उपयोग पर ब्राउज़र इस साइट से पहचान इंजन और चुना गया भाषा मॉडल एक बार डाउनलोड करता है (कुछ मेगाबाइट, same-origin, कोई विदेशी सर्वर नहीं); उसके बाद टूल ऑफलाइन भी काम करता है। एक साथ कई छवियां डालें - हर एक अपनी TXT बनाती है।
पहचान की गुणवत्ता लगभग पूरी तरह स्रोत पर निर्भर करती है: मुद्रित टेक्स्ट वाली स्पष्ट, सीधी और उच्च-कंट्रास्ट वाली फोटो बहुत अच्छी तरह पहचानी जाती है; तिरछी, धुंधली या अंधेरी छवि काफी खराब। मुद्रित लिपि विश्वसनीय रूप से काम करती है, हस्तलिपि नहीं। कॉलम, तालिकाएं और असामान्य लेआउट सतत टेक्स्ट के रूप में निकलते हैं - क्रम आमतौर पर सही होता है, लेकिन दृश्य संरचना खो जाती है। परिणाम की हमेशा जांच करें, खासकर संख्याओं और नामों के लिए।
सूची से दस्तावेज़ की भाषा चुनें (100 से अधिक भाषाएं)।
पहचाना गया टेक्स्ट TXT के रूप में डाउनलोड करें।
सीमाएँ: स्पष्ट छवियों (JPG, PNG, WebP, BMP) से मुद्रित टेक्स्ट को TXT के रूप में पहचानता है; हस्तलिपि विश्वसनीय रूप से नहीं पहचानी जाती। 100 से अधिक भाषाएं और कई लिपियां (लैटिन, सिरिलिक, ग्रीक, अरबी, हिब्रू, भारतीय लिपियां, CJK और अन्य) - अपने दस्तावेज़ के लिए उपयुक्त चुनें। कॉलम/तालिका/लेआउट संरचना के रूप में नहीं, केवल सतत टेक्स्ट के रूप में निकलते हैं। पहचान त्रुटि-मुक्त नहीं है - परिणाम जांचें, खासकर संख्याएं और उचित नाम। पहली बार उपयोग पर इंजन और चुना गया भाषा मॉडल एक बार डाउनलोड होता है (कुछ MB, same-origin); बाद में ऑफलाइन उपयोग संभव। स्कैन किए गए PDF के लिए समर्पित "PDF OCR" टूल उपयोग करें (खोजने योग्य या सादा टेक्स्ट)।
अक्सर पूछे जाने वाले प्रश्न
क्या मेरी छवि अपलोड होती है?
नहीं। टेक्स्ट पहचान पूरी तरह ब्राउज़र में स्थानीय रूप से चलती है (WebAssembly); छवि कभी आपके डिवाइस से नहीं जाती - संवेदनशील दस्तावेज़ों के लिए निर्णायक फायदा।
कौन सी भाषाएं समर्थित हैं?
100 से अधिक भाषाएं और कई लिपियां - हिंदी और अंग्रेज़ी के अलावा फ्रेंच, स्पेनिश, रूसी, अरबी, हिब्रू, जापानी, कोरियाई, चीनी और बहुत कुछ। विशेष अक्षरों की सही पहचान के लिए सूची से उचित भाषा चुनें।
क्या यह हस्तलिपि पहचानता है?
नहीं, केवल मुद्रित टेक्स्ट विश्वसनीय रूप से पहचाना जाता है। यह इंजन हस्तलिपि को लगातार नहीं पहचान सकता।
पहचान कभी-कभी गलत क्यों होती है?
OCR छवि की गुणवत्ता पर निर्भर करता है: स्पष्ट, सीधा और उच्च-कंट्रास्ट सबसे अच्छा परिणाम देता है; तिरछा, धुंधला या अंधेरा काफी खराब। संख्याएं और उचित नाम हमेशा दोबारा जांचें।
क्या मैं स्कैन किया गया PDF पहचान सकता हूं?
हां, उसके लिए समर्पित "PDF OCR" टूल है: यह स्कैन किए गए PDF को सीधे खोजने योग्य बनाता है या सादा टेक्स्ट देता है - अलग-अलग छवियों में बदलने की जरूरत नहीं।
केवल आपकी सहमति से ही हम gottrix को बेहतर बनाने के लिए कुकीज़ के ज़रिए उपयोग को गुमनाम रूप से मापते हैं। आपकी फ़ाइलें हमेशा आपके डिवाइस पर ही स्थानीय रहती हैं। गोपनीयता