मोफत OCR — इमेज ते मजकूर एक्स्ट्रॅक्टर

PP-OCRv5 वापरून प्रतिमा, स्क्रीनशॉट, स्कॅन केलेले दस्तऐवज आणि PDF मधील मजकूर काढा (किंवा शोधता येणारी PDF जतन करा), तेही पूर्णपणे तुमच्या ब्राउझरमध्ये. लॅटिन, चिनी, जपानी, कोरियन, सिरिलिक, अरबी, देवनागरी, थाई, ग्रीक, तमिळ आणि तेलुगू लिपी वाचते.

अनेक ऑनलाइन OCR साइट्स तासाला किंवा दिवसाला मोफत पाने मर्यादित करतात — इथे मर्यादा नाही, व इमेज तुमच्या डिव्हाइसवर राहते.

फाइल्स इथे टाका, किंवा ब्राउझ करण्यासाठी क्लिक करा

JPG, PNG, WebP, BMP, PDF, HEIC, HEIF · फाइल आकाराची मर्यादा नाही

किंवा क्लिपबोर्डवरून पेस्ट करण्यासाठी Ctrl+V दाबा

तुम्ही एकाच वेळी अनेक फाइल्स टाकू शकता

फाइल्स ब्राउझ करा

टीप: तुम्ही Ctrl+V ने स्क्रीनशॉट पेस्ट करू शकता

जाड

तुमच्या फाइल्स तुमच्या डिव्हाइसवरून जात नाहीत. सर्व प्रक्रिया तुमच्या ब्राउझरमध्ये स्थानिकरित्या होते.

हे कसे कार्य करते

येथील OCR (ऑप्टिकल कॅरेक्टर रेकग्निशन) PP-OCRv5 वापरते, जो PaddleOCR प्रकल्पातील ओपन-सोर्स मॉडेल संच आहे, थेट तुमच्या ब्राउझरमध्ये चालतो. ते फोटो किंवा स्कॅनमधील छापील मजकूर वाचते, इमेज कधीही तुमचे डिव्हाइस न सोडता.

  1. 1
    प्रथम मजकूर विभाग शोधले जातात
    एक डिटेक्शन मॉडेल इमेज स्कॅन करून मजकुराच्या ओळीसारखे दिसणारे प्रत्येक भाग रेखांकित करते, सर्वात लांब बाजू सुमारे 960 पिक्सेल असलेल्या प्रतीवर काम करत. यामुळेच पावतीच्या फोटोवरही हे टूल काम करते: मॉडेल संपूर्ण इमेज स्वच्छ पान आहे असे गृहीत न धरता मजकूर शोधते. हा टप्पा कोणत्याही भाषेसाठी सारखाच असतो, त्यामुळे तो एकदाच — सुमारे 12 MB — डाउनलोड होतो आणि पुन्हा वापरला जातो.
  2. 2
    तुमच्या लिपीसाठी एक रेकग्नायझर डाउनलोड होतो
    आकार वाचणे लिपी-विशिष्ट असते, त्यामुळे तुम्ही निवडलेल्या लेखन पद्धतीसाठी दुसरे मॉडेल आणले जाते — बहुतेकांसाठी सुमारे 8 MB, कोरियनसाठी 13 MB आणि चिनी व जपानीसाठी 17 MB. Latin निवडल्यास एकूण सुमारे 19 MB लागतात. प्रत्येक मॉडेल कॅश केले जाते, त्यामुळे आधी वापरलेल्या लिपीवर परत गेल्यास काहीही डाउनलोड होत नाही.
  3. 3
    प्रत्येक ओळ सरळ करून वाचली जाते
    प्रत्येक शोधलेली ओळ तिच्या ओरिएंटेशनसाठी तपासली जाते, गरज असल्यास सरळ केली जाते, नंतर रेकग्नायझरकडे पाठवली जाते, जो ती अक्षराक्षराने वाचतो. वाचनाचा क्रम नंतर पुन्हा तयार होतो, वर-खाली आणि डावी-उजवीकडे, त्यामुळे आउटपुट डिटेक्टरला बॉक्सेस सापडलेल्या क्रमाऐवजी तुम्हाला दिसणाऱ्या मांडणीशी जुळते.
  4. 4
    मजकूर बॉक्सेस आणि विश्वासार्हतेसह परत येतो
    प्रत्येक ओळीत एक विश्वासार्हता गुण आणि ती ज्या निर्देशांकांवरून आली त्याची माहिती असते, त्यामुळे नेमके काय कुठून वाचले गेले हे तुम्हाला दिसते, आणि ती स्थाने कायम ठेवणारा hOCR एक्सपोर्ट करता येतो. स्वच्छ, उच्च-कॉन्ट्रास्ट मजकुरासाठी 90% पेक्षा जास्त गुण मिळतात; कमी रिझोल्यूशन, चकाकी आणि हस्ताक्षर हे गुण कमी करतात.

तुमच्या इमेज तुमच्या डिव्हाइसवरच राहतात - प्रोसेसिंगसाठी तात्पुरत्याही अपलोड होत नाहीत. मॉडेल फाइल्स आमच्या स्वतःच्या सर्व्हरवरून डाउनलोड होतात, कधीही तृतीय-पक्ष CDN वरून नाही. ID दस्तऐवज, करार, वैद्यकीय कागदपत्रे किंवा कोणत्याही संवेदनशील मजकुरासाठी सुरक्षित.

संबंधित साधने

📸

व्हिडिओ फ्रेम ग्रॅबर

व्हिडिओच्या कोणत्याही फ्रेमचे पूर्ण रिझोल्यूशनमध्ये स्थिर चित्र मिळवा. स्क्रब करा, फ्रेम-बाय-फ्रेम पहा आणि PNG किंवा JPG म्हणून सेव्ह करा. त्वरित आणि पूर्णपणे तुमच्या ब्राउझरमध्ये.

प्रयत्न कराफाइल्स स्थानिक राहतात
🖼️

इमेज स्टेगॅनोग्राफी (प्रतिमेत मजकूर लपवा)

लीस्ट-सिग्निफिकंट-बिट स्टेगॅनोग्राफी वापरून PNG मध्ये गुप्त मजकूर संदेश लपवा, पर्यायी AES-256-GCM पासवर्ड एन्क्रिप्शनसह. नंतर त्याच टूलने तो काढा. सर्व काही तुमच्या ब्राउझरमध्येच चालते.

प्रयत्न कराफाइल्स स्थानिक राहतात
🎨

इमेज रंग पॅलेट एक्स्ट्रॅक्टर

k-means रंग क्वांटायझेशन वापरून कोणत्याही इमेजमधील प्रमुख रंग काढा. तुमच्या फोटो किंवा लोगोमधील टॉप 2-16 रंगांचे हेक्स कोड मिळवा.

प्रयत्न कराफाइल्स स्थानिक राहतात

वारंवार विचारले जाणारे प्रश्न