ఉచిత OCR — చిత్రం నుండి టెక్స్ట్ ఎక్స్‌ట్రాక్టర్

PP-OCRv5తో చిత్రాలు, స్క్రీన్‌షాట్‌లు, స్కాన్ చేసిన డాక్యుమెంట్లు మరియు PDFల నుండి టెక్స్ట్‌ను తీయండి (లేదా వెతకగలిగే PDFగా సేవ్ చేయండి), పూర్తిగా మీ బ్రౌజర్‌లోనే. లాటిన్, చైనీస్, జపనీస్, కొరియన్, సిరిలిక్, అరబిక్, దేవనాగరి, థాయ్, గ్రీక్, తమిళం మరియు తెలుగు లిపిని చదువుతుంది.

అనేక ఆన్‌లైన్ OCR సైట్‌లు గంటకు లేదా రోజుకు ఉచిత పేజీలను పరిమితం చేస్తాయి — ఇక్కడ పరిమితి లేదు, మరియు ఇమేజ్ మీ డివైజ్‌లోనే ఉంటుంది.

ఫైల్‌లను ఇక్కడ వదలండి, లేదా బ్రౌజ్ చేయడానికి క్లిక్ చేయండి

JPG, PNG, WebP, BMP, PDF, HEIC, HEIF · ఫైల్ పరిమాణ పరిమితి లేదు

లేదా మీ క్లిప్‌బోర్డ్ నుండి పేస్ట్ చేయడానికి Ctrl+V నొక్కండి

మీరు ఒకేసారి అనేక ఫైల్‌లను వదలవచ్చు

ఫైల్‌లు బ్రౌజ్ చేయండి

చిట్కా: మీరు Ctrl+Vతో స్క్రీన్‌షాట్‌ను పేస్ట్ చేయవచ్చు

స్కాన్ చేసిన PDFలు కూడా పనిచేస్తాయి: ప్రతి పేజీ చదవబడుతుంది, మరియు మీకు శోధించదగిన PDF తిరిగి లభిస్తుంది.

మీ ఫైల్‌లు మీ పరికరం వదలవు. అన్ని ప్రాసెసింగ్ మీ బ్రౌజర్‌లో స్థానికంగా జరుగుతుంది.

ఇది ఎలా పనిచేస్తుంది

ఇక్కడ OCR (ఆప్టికల్ క్యారెక్టర్ రికగ్నిషన్) PaddleOCR ప్రాజెక్ట్ నుండి ఓపెన్-సోర్స్ మోడల్ సెట్ అయిన PP-OCRv5 ను నేరుగా మీ బ్రౌజర్‌లో నడుపుతుంది. చిత్రం మీ పరికరాన్ని వదలకుండానే అది ఫోటో లేదా స్కాన్ నుండి ప్రింట్ చేసిన టెక్స్ట్‌ను చదువుతుంది.

  1. 1
    టెక్స్ట్ ప్రాంతాలు ముందుగా కనుగొనబడతాయి
    ఒక డిటెక్షన్ మోడల్ చిత్రాన్ని స్కాన్ చేసి టెక్స్ట్ లైన్‌లా కనిపించే ప్రతి ప్యాచ్‌ను గుర్తిస్తుంది, దాని పొడవైన అంచు సుమారు 960 పిక్సెల్‌లుగా స్కేల్ చేసిన కాపీపై పని చేస్తూ. అందుకే ఒక రసీదు ఫోటో పని చేస్తుంది: మోడల్ మొత్తం చిత్రాన్ని క్లీన్ పేజీగా భావించకుండా టెక్స్ట్‌ను గుర్తిస్తుంది. ఈ దశ మీరు చదువుతున్న భాషతో సంబంధం లేకుండా ఒకేలా ఉంటుంది, కాబట్టి ఇది ఒకసారి — సుమారు 12 MB — డౌన్‌లోడ్ అయి తిరిగి ఉపయోగించబడుతుంది.
  2. 2
    మీ లిపి కోసం ఒక రికగ్నైజర్ డౌన్‌లోడ్ అవుతుంది
    ఆకారాలను చదవడం లిపి-నిర్దిష్టమైనది, కాబట్టి మీరు ఎంచుకున్న రాత విధానం కోసం రెండవ మోడల్ తీసుకురాబడుతుంది - చాలా వాటికి సుమారు 8 MB, కొరియన్‌కు 13 MB, చైనీస్, జపనీస్‌కు 17 MB. Latin ఎంచుకోవడం మొత్తం సుమారు 19 MB ఖర్చవుతుంది. ప్రతి ఒక్కటి కాష్ చేయబడుతుంది, కాబట్టి మీరు ముందు ఉపయోగించిన లిపికి తిరిగి మారడం ఏమీ డౌన్‌లోడ్ చేయదు.
  3. 3
    ప్రతి లైన్ నిటారుగా చేసి చదవబడుతుంది
    గుర్తించిన ప్రతి లైన్ ఓరియంటేషన్ కోసం తనిఖీ చేయబడుతుంది, అవసరమైతే నిటారుగా తిప్పబడుతుంది, తర్వాత రికగ్నైజర్‌కు పంపబడుతుంది, అది దాన్ని అక్షరం అక్షరంగా చదువుతుంది. చదివే క్రమం తర్వాత పునర్నిర్మించబడుతుంది, పైనుండి క్రిందికి, ఎడమ నుండి కుడికి, కాబట్టి అవుట్‌పుట్ డిటెక్టర్ బాక్స్‌లను కనుగొన్న క్రమానికి కాకుండా మీకు కనిపించే లేఅవుట్‌కు సరిపోతుంది.
  4. 4
    టెక్స్ట్ బాక్స్‌లు, కాన్ఫిడెన్స్‌తో తిరిగి వస్తుంది
    ప్రతి లైన్‌కు ఒక కాన్ఫిడెన్స్ స్కోర్, అది వచ్చిన కోఆర్డినేట్‌లు ఉంటాయి, కాబట్టి మీరు ఎక్కడ నుండి ఏమి చదవబడిందో సరిగ్గా చూడవచ్చు, ఆ స్థానాలను ఉంచే hOCR ను ఎక్స్‌పోర్ట్ చేయవచ్చు. క్లీన్, హై-కాంట్రాస్ట్ టెక్స్ట్ 90% పైన స్కోర్ చేస్తుంది; తక్కువ రిజల్యూషన్, గ్లేర్, హ్యాండ్‌రైటింగ్ దాన్ని తగ్గిస్తాయి.

మీ చిత్రాలు మీ పరికరంలోనే ఉంటాయి - ప్రాసెసింగ్ కోసం తాత్కాలికంగా కూడా అప్‌లోడ్ చేయబడవు. మోడల్ ఫైళ్ళు మా సొంత సర్వర్ నుండి డౌన్‌లోడ్ అవుతాయి, థర్డ్-పార్టీ CDN నుండి కాదు. ID డాక్యుమెంట్‌లు, కాంట్రాక్టులు, వైద్య పేపర్‌వర్క్, లేదా సున్నితమైన కంటెంట్ ఉన్న ఏ టెక్స్ట్‌కైనా సురక్షితం.

సంబంధిత సాధనాలు

📸

వీడియో ఫ్రేమ్ గ్రాబర్

వీడియోలో ఏదైనా ఫ్రేమ్ నుండి పూర్తి రిజల్యూషన్‌లో స్టిల్ చిత్రాన్ని క్యాప్చర్ చేయండి. స్క్రబ్ చేయండి, ఫ్రేమ్-బై-ఫ్రేమ్ స్టెప్ చేయండి, PNG లేదా JPGగా సేవ్ చేయండి. తక్షణం మరియు పూర్తిగా మీ బ్రౌజర్‌లోనే.

ప్రయత్నించండిఫైల్‌లు స్థానికంగా ఉంటాయి
🖼️

ఇమేజ్ స్టెగనోగ్రఫీ (చిత్రంలో టెక్స్ట్ దాచండి)

లీస్ట్-సిగ్నిఫికెంట్-బిట్ స్టెగనోగ్రఫీని ఉపయోగించి PNGలో రహస్య టెక్స్ట్ సందేశాన్ని దాచండి, ఐచ్ఛికంగా AES-256-GCM పాస్‌వర్డ్ ఎన్‌క్రిప్షన్‌తో. అదే టూల్‌తో తర్వాత దాన్ని తీయండి. అంతా మీ బ్రౌజర్‌లోనే జరుగుతుంది.

ప్రయత్నించండిఫైల్‌లు స్థానికంగా ఉంటాయి
🎨

చిత్రం కలర్ పాలెట్ ఎక్స్‌ట్రాక్టర్

k-means కలర్ క్వాంటైజేషన్‌ను ఉపయోగించి ఏదైనా చిత్రం నుండి ప్రధాన రంగులను తీయండి. మీ ఫోటో లేదా లోగోలో టాప్ 2-16 రంగుల కోసం హెక్స్ కోడ్‌లను పొందండి.

ప్రయత్నించండిఫైల్‌లు స్థానికంగా ఉంటాయి

తరచుగా అడిగే ప్రశ్నలు