OCR — Nxjerrës Teksti nga Imazhi Falas

Nxirr tekstin nga imazhet, pamjet e ekranit, dokumentet e skanuara dhe PDF-të (ose ruaje si PDF të kërkueshëm) me PP-OCRv5, tërësisht në shfletuesin tënd. Lexon shkrimin latin, kinez, japonez, korean, cirilik, arab, devanagari, tajlandez, grek, tamil dhe telugu.

Shumë faqe OCR online kufizojnë faqet falas për orë ose ditë — këtu nuk ka kufi, dhe imazhi mbetet në pajisjen tënde.

Hidhini skedarët këtu ose klikoni për të shfletuar

JPG, PNG, WebP, BMP, PDF, HEIC, HEIF · Nuk ka kufi për madhësinë e skedarit

ose shtypni Ctrl+V për të ngjitur nga clipboard

Mund të lëshoni shumë skedarë në të njëjtën kohë

Shfletoni skedarët

Këshillë: mund të ngjitësh një pamje ekrani me Ctrl+V

PDF-të e skanuara funksionojnë gjithashtu: çdo faqe lexohet dhe merrni një PDF me kërkim.

Skedarët tuaj nuk largohen kurrë nga pajisja juaj. I gjithë përpunimi ndodh lokalisht në shfletuesin tuaj.

Si funksionon

OCR (Njohja Optike e Karaktereve) këtu funksionon me PP-OCRv5, një grup modelesh me burim të hapur nga projekti PaddleOCR, direkt në shfletuesin tuaj. Lexon tekst të shtypur nga një fotografi ose skanim pa e nxjerrë kurrë imazhin nga pajisja juaj.

  1. 1
    Zonat e tekstit gjenden së pari
    Një model zbulimi skanon imazhin dhe rrethon çdo pjesë që duket si rresht teksti, duke punuar mbi një kopje të shkallëzuar kështu që skaja e saj më e gjatë të jetë rreth 960 pikselë. Kjo është arsyeja pse një fotografi e një faturë funksionon: modeli lokalizon tekstin në vend që të supozojë se i gjithë imazhi është një faqe e pastër. Kjo fazë është e njëjtë pavarësisht gjuhës që lexoni, kështu që shkarkohet një herë - rreth 12 MB - dhe ripërdoret.
  2. 2
    Njohësi shkarkohet për shkrimin tuaj
    Leximi i formave është specifik për shkrimin, kështu që një model i dytë merret për sistemin e shkrimit që zgjodhët - rreth 8 MB për shumicën, 13 MB për koreanishten dhe 17 MB për kinezishten dhe japonishten. Zgjedhja e latinishtes kushton rreth 19 MB në total. Secili ruhet në cache, kështu që kalimi mbrapsht në një shkrim që keni përdorur më parë nuk shkarkon asgjë.
  3. 3
    Çdo rresht drejtohet dhe lexohet
    Çdo rresht i zbuluar kontrollohet për orientim, rrotullohet drejt nëse nevojitet, më pas kalohet te njohësi, i cili e lexon karakter për karakter. Rradha e leximit rindërtohet më pas, nga sipër poshtë dhe majtas djathtas, kështu që rezultati përputhet me paraqitjen që shihni në vend të rradhës në të cilën zbuluesi i gjeti kutitë.
  4. 4
    Teksti kthehet me kuti dhe besueshmëri
    Çdo rresht mban një pikë besueshmërie dhe koordinatat nga ku erdhi, kështu që mund të shihni saktësisht çfarë u lexua nga ku, dhe të eksportoni hOCR që ruan ato pozicione. Teksti i pastër, me kontrast të lartë ka rezultat mbi 90%; rezolucioni i ulët, shkëlqimi dhe shkrimi me dorë e ulin atë.

Imazhet tuaja mbeten në pajisjen tuaj - as edhe përkohësisht të ngarkuara për përpunim. Vetë skedarët e modelit shkarkohen nga serveri ynë, kurrë nga një CDN i palës së tretë. I sigurt për dokumente identiteti, kontrata, dokumente mjekësore, ose çdo tekst me përmbajtje të ndjeshme.

Mjete të ngjashme

Pyetjet e bëra më shpesh