મફત OCR — ઇમેજથી ટેક્સ્ટ એક્સટ્રેક્ટર

PP-OCRv5 વડે છબીઓ, સ્ક્રીનશોટ, સ્કેન કરેલા દસ્તાવેજો અને PDF માંથી ટેક્સ્ટ કાઢો (અથવા શોધી શકાય તેવી PDF સાચવો), સંપૂર્ણપણે તમારા બ્રાઉઝરમાં ચાલે છે. લૅટિન, ચાઇનીઝ, જાપાનીઝ, કોરિયન, સિરિલિક, અરબી, દેવનાગરી, થાઈ, ગ્રીક, તમિલ અને તેલુગુ લિપિ વાંચે છે.

ઘણી ઓનલાઇન OCR સાઇટ્સ કલાક કે દિવસ દીઠ ફ્રી પેજ મર્યાદિત કરે છે — અહીં કોઈ મર્યાદા નથી, અને ઇમેજ તમારા ડિવાઇસ પર જ રહે છે.

ફાઇલો અહીં મૂકો, અથવા બ્રાઉઝ કરવા ક્લિક કરો

JPG, PNG, WebP, BMP, PDF, HEIC, HEIF · ફાઇલ કદ મર્યાદા નહીં

અથવા તમારા ક્લિપબોર્ડમાંથી પેસ્ટ કરવા માટે Ctrl+V દબાવો

તમે એક સાથે ઘણી ફાઇલો મૂકી શકો છો

ફાઇલો બ્રાઉઝ કરો

ટિપ: તમે Ctrl+V થી સ્ક્રીનશોટ પેસ્ટ કરી શકો છો

સ્કેન કરેલા PDF પણ કામ કરે છે: દરેક પેજ વંચાય છે, અને તમને શોધી શકાય તેવું PDF પાછું મળે છે.

તમારી ફાઇલો તમારા ઉપકરણ છોડતી નથી. બધી પ્રક્રિયા તમારા બ્રાઉઝરમાં સ્થાનિક રીતે થાય છે.

આ કેવી રીતે કાર્ય કરે છે

અહીં OCR (Optical Character Recognition) PP-OCRv5 ચલાવે છે, PaddleOCR પ્રોજેક્ટનો ઓપન-સોર્સ model સેટ, સીધો તમારા બ્રાઉઝરમાં. તે ફોટો કે સ્કેનમાંથી છાપેલો ટેક્સ્ટ વાંચે છે, ઇમેજ ક્યારેય તમારું ડિવાઇસ છોડ્યા વગર.

  1. 1
    પહેલાં ટેક્સ્ટ regions શોધાય છે
    એક detection model ઇમેજ સ્કેન કરે છે અને ટેક્સ્ટની લાઇન જેવો દેખાતો દરેક patch outline કરે છે, જે લગભગ 960 pixels ની longest edge સુધી scaled copy પર કામ કરે છે. એટલે જ receipt નો ફોટો કામ કરે છે: model ટેક્સ્ટ શોધે છે, આખી ઇમેજને સાફ પેજ ન ગણીને. આ તબક્કો તમે કયી ભાષા વાંચો છો તેનાથી અલગ નથી, એટલે તે એક વાર ડાઉનલોડ થાય છે - લગભગ 12 MB - અને ફરી વાપરવામાં આવે છે.
  2. 2
    તમારી script માટે એક recogniser ડાઉનલોડ થાય છે
    આકારો વાંચવું script-specific છે, એટલે તમે પસંદ કરેલી writing system માટે બીજો model fetch થાય છે - મોટાભાગના માટે લગભગ 8 MB, Korean માટે 13 MB, અને Chinese અને Japanese માટે 17 MB. Latin પસંદ કરવાનો કુલ ખર્ચ લગભગ 19 MB છે. દરેક કેશ થાય છે, એટલે અગાઉ વાપરેલી script પર પાછા જવાથી કંઈ ડાઉનલોડ થતું નથી.
  3. 3
    દરેક લાઇન સીધી કરીને વાંચવામાં આવે છે
    દરેક શોધાયેલી લાઇન orientation માટે તપાસાય છે, જરૂર પડે તો સીધી કરવામાં આવે છે, પછી recogniser ને પાસ કરવામાં આવે છે, જે તેને character-by-character વાંચે છે. Reading order પછીથી ફરી બનાવવામાં આવે છે, ઉપરથી નીચે અને ડાબેથી જમણે, જેથી આઉટપુટ તમે જોઈ શકો છો તે layout સાથે મેચ થાય, detector ને boxes ક્યારે મળ્યા તેના ક્રમ સાથે નહીં.
  4. 4
    ટેક્સ્ટ boxes અને confidence સાથે પાછો આવે છે
    દરેક લાઇન એક confidence score અને તે ક્યાંથી આવી તેના coordinates ધરાવે છે, જેથી તમે બરાબર જોઈ શકો કે ક્યાંથી શું વાંચવામાં આવ્યું, અને એ positions જાળવતું hOCR export કરી શકો. સાફ, high-contrast ટેક્સ્ટ 90% થી વધુ સ્કોર કરે છે; ઓછું resolution, ચમક, અને હસ્તાક્ષર તેને ઘટાડે છે.

તમારી ઇમેજો તમારા ડિવાઇસ પર જ રહે છે - પ્રોસેસિંગ માટે અસ્થાયી રીતે પણ અપલોડ થતી નથી. Model ફાઇલો પોતે અમારા પોતાના સર્વર પરથી ડાઉનલોડ થાય છે, ક્યારેય third-party CDN પરથી નહીં. ID documents, contracts, medical paperwork, અથવા સંવેદનશીલ કન્ટેન્ટ ધરાવતા કોઈ પણ ટેક્સ્ટ માટે સુરક્ષિત.

સંબંધિત સાધનો

📸

વિડિયો ફ્રેમ ગ્રેબર

વિડિયોના કોઈપણ ફ્રેમમાંથી પૂર્ણ રિઝોલ્યુશન પર સ્ટિલ ઇમેજ કેપ્ચર કરો. સ્ક્રબ કરો, ફ્રેમ-બાય-ફ્રેમ સ્ટેપ કરો અને PNG કે JPG તરીકે સેવ કરો. તાત્કાલિક અને સંપૂર્ણપણે તમારા બ્રાઉઝરમાં.

પ્રયાસ કરોફાઇલો સ્થાનિક રહે છે
🖼️

ઇમેજ સ્ટેગેનોગ્રાફી (ઇમેજમાં ટેક્સ્ટ છુપાવો)

લીસ્ટ-સિગ્નિફિકન્ટ-બિટ સ્ટેગેનોગ્રાફી વાપરી PNG માં ગુપ્ત ટેક્સ્ટ સંદેશ છુપાવો, વૈકલ્પિક AES-256-GCM પાસવર્ડ એન્ક્રિપ્શન સાથે. પછીથી એ જ ટૂલ વડે તેને કાઢો. બધું તમારા બ્રાઉઝરમાં ચાલે છે.

પ્રયાસ કરોફાઇલો સ્થાનિક રહે છે
🎨

ઇમેજ કલર પેલેટ એક્સટ્રેક્ટર

k-means કલર ક્વોન્ટાઇઝેશન વાપરીને કોઈપણ ઇમેજમાંથી પ્રભાવશાળી રંગો એક્સટ્રેક્ટ કરો. તમારા ફોટા કે લોગોના ટોપ 2-16 રંગોના હેક્સ કોડ મેળવો.

પ્રયાસ કરોફાઇલો સ્થાનિક રહે છે

વારંવાર પૂછાતા પ્રશ્નો