ਮੁਫ਼ਤ OCR — ਚਿੱਤਰ ਤੋਂ ਟੈਕਸਟ ਐਕਸਟ੍ਰੈਕਟਰ
PP-OCRv5 ਨਾਲ ਤਸਵੀਰਾਂ, ਸਕ੍ਰੀਨਸ਼ਾਟ, ਸਕੈਨ ਕੀਤੇ ਦਸਤਾਵੇਜ਼ਾਂ ਅਤੇ PDF ਵਿੱਚੋਂ ਟੈਕਸਟ ਕੱਢੋ (ਜਾਂ ਖੋਜਣਯੋਗ PDF ਸੇਵ ਕਰੋ), ਪੂਰੀ ਤਰ੍ਹਾਂ ਤੁਹਾਡੇ ਬ੍ਰਾਊਜ਼ਰ ਵਿੱਚ। ਲਾਤੀਨੀ, ਚੀਨੀ, ਜਾਪਾਨੀ, ਕੋਰੀਆਈ, ਸਿਰਿਲਿਕ, ਅਰਬੀ, ਦੇਵਨਾਗਰੀ, ਥਾਈ, ਯੂਨਾਨੀ, ਤਮਿਲ ਅਤੇ ਤੇਲਗੂ ਲਿਪੀ ਪੜ੍ਹਦਾ ਹੈ।
ਕਈ ਔਨਲਾਈਨ OCR ਸਾਈਟਾਂ ਮੁਫ਼ਤ ਪੰਨਿਆਂ ਨੂੰ ਪ੍ਰਤੀ ਘੰਟਾ ਜਾਂ ਪ੍ਰਤੀ ਦਿਨ ਸੀਮਿਤ ਕਰਦੀਆਂ ਹਨ — ਇੱਥੇ ਕੋਈ ਹੱਦ ਨਹੀਂ, ਅਤੇ ਚਿੱਤਰ ਤੁਹਾਡੀ ਡਿਵਾਈਸ 'ਤੇ ਰਹਿੰਦਾ ਹੈ।
ਫਾਈਲਾਂ ਨੂੰ ਇੱਥੇ ਸੁੱਟੋ, ਜਾਂ ਬ੍ਰਾਊਜ਼ ਕਰਨ ਲਈ ਕਲਿੱਕ ਕਰੋ
JPG, PNG, WebP, BMP, PDF, HEIC, HEIF · ਕੋਈ ਫਾਈਲ ਆਕਾਰ ਸੀਮਾ ਨਹੀਂ ਹੈ
ਜਾਂ ਆਪਣੇ ਕਲਿੱਪਬੋਰਡ ਤੋਂ ਪੇਸਟ ਕਰਨ ਲਈ Ctrl+V ਦਬਾਓ
ਤੁਸੀਂ ਇੱਕ ਵਾਰ ਵਿੱਚ ਕਈ ਫਾਈਲਾਂ ਛੱਡ ਸਕਦੇ ਹੋ
ਸੁਝਾਅ: ਤੁਸੀਂ Ctrl+V ਨਾਲ ਸਕ੍ਰੀਨਸ਼ਾਟ ਪੇਸਟ ਕਰ ਸਕਦੇ ਹੋ
ਸਕੈਨ ਕੀਤੇ PDF ਵੀ ਕੰਮ ਕਰਦੇ ਹਨ: ਹਰੇਕ ਸਫ਼ਾ ਪੜ੍ਹਿਆ ਜਾਂਦਾ ਹੈ, ਅਤੇ ਤੁਹਾਨੂੰ ਖੋਜਣਯੋਗ PDF ਵਾਪਸ ਮਿਲਦੀ ਹੈ।
ਤੁਹਾਡੀਆਂ ਫ਼ਾਈਲਾਂ ਕਦੇ ਵੀ ਤੁਹਾਡੀ ਡੀਵਾਈਸ ਨੂੰ ਨਹੀਂ ਛੱਡਦੀਆਂ। ਸਾਰੀ ਪ੍ਰਕਿਰਿਆ ਤੁਹਾਡੇ ਬ੍ਰਾਊਜ਼ਰ ਵਿੱਚ ਸਥਾਨਕ ਤੌਰ 'ਤੇ ਹੁੰਦੀ ਹੈ।
ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ
ਇੱਥੇ OCR (Optical Character Recognition) PP-OCRv5 ਚਲਾਉਂਦਾ ਹੈ, ਜੋ PaddleOCR ਪ੍ਰੋਜੈਕਟ ਦੇ ਓਪਨ-ਸੋਰਸ ਮਾਡਲ ਸੈੱਟ ਤੋਂ ਹੈ, ਸਿੱਧਾ ਤੁਹਾਡੇ ਬ੍ਰਾਊਜ਼ਰ ਵਿੱਚ। ਇਹ ਫੋਟੋ ਜਾਂ ਸਕੈਨ ਤੋਂ ਪ੍ਰਿੰਟ ਕੀਤਾ ਟੈਕਸਟ ਪੜ੍ਹਦਾ ਹੈ, ਬਿਨਾਂ ਚਿੱਤਰ ਨੂੰ ਤੁਹਾਡੀ ਡਿਵਾਈਸ ਤੋਂ ਬਾਹਰ ਭੇਜੇ।
- 1ਟੈਕਸਟ ਖੇਤਰ ਪਹਿਲਾਂ ਲੱਭੇ ਜਾਂਦੇ ਹਨਇੱਕ ਪਛਾਣ ਮਾਡਲ ਚਿੱਤਰ ਨੂੰ ਸਕੈਨ ਕਰਦਾ ਹੈ ਅਤੇ ਟੈਕਸਟ ਦੀ ਲਾਈਨ ਵਰਗੇ ਲੱਗਣ ਵਾਲੇ ਹਰ ਹਿੱਸੇ ਦੀ ਰੂਪਰੇਖਾ ਬਣਾਉਂਦਾ ਹੈ, ਇੱਕ ਕਾਪੀ 'ਤੇ ਕੰਮ ਕਰਦਾ ਹੈ ਜਿਸਦਾ ਸਭ ਤੋਂ ਲੰਬਾ ਕਿਨਾਰਾ ਲਗਭਗ 960 ਪਿਕਸਲ ਹੋਣ ਤੱਕ ਪੈਮਾਨਾ ਬਣਾਇਆ ਜਾਂਦਾ ਹੈ। ਇਸੇ ਲਈ ਰਸੀਦ ਦੀ ਫੋਟੋ 'ਤੇ ਕੰਮ ਕਰਦਾ ਹੈ — ਮਾਡਲ ਪੂਰੇ ਚਿੱਤਰ ਨੂੰ ਸਾਫ਼ ਪੰਨਾ ਮੰਨਣ ਦੀ ਬਜਾਏ ਟੈਕਸਟ ਲੱਭਦਾ ਹੈ। ਇਹ ਪੜਾਅ ਤੁਹਾਡੀ ਭਾਸ਼ਾ ਦੀ ਪਰਵਾਹ ਕੀਤੇ ਬਿਨਾਂ ਇੱਕੋ ਜਿਹਾ ਹੈ, ਇਸ ਲਈ ਇਹ ਇੱਕ ਵਾਰ - ਲਗਭਗ 12 MB - ਡਾਊਨਲੋਡ ਹੁੰਦਾ ਹੈ ਅਤੇ ਮੁੜ ਵਰਤਿਆ ਜਾਂਦਾ ਹੈ।
- 2ਤੁਹਾਡੀ ਲਿਪੀ ਲਈ ਇੱਕ ਪਛਾਣਕਰਤਾ ਡਾਊਨਲੋਡ ਹੁੰਦਾ ਹੈਆਕਾਰ ਪੜ੍ਹਨਾ ਲਿਪੀ-ਵਿਸ਼ੇਸ਼ ਹੁੰਦਾ ਹੈ, ਇਸ ਲਈ ਤੁਹਾਡੇ ਚੁਣੇ ਲਿਖਣ ਸਿਸਟਮ ਲਈ ਇੱਕ ਦੂਜਾ ਮਾਡਲ ਲਿਆਂਦਾ ਜਾਂਦਾ ਹੈ - ਜ਼ਿਆਦਾਤਰ ਲਈ ਲਗਭਗ 8 MB, ਕੋਰੀਅਨ ਲਈ 13 MB ਅਤੇ ਚੀਨੀ ਅਤੇ ਜਾਪਾਨੀ ਲਈ 17 MB। ਲਾਤੀਨੀ ਚੁਣਨ ਨਾਲ ਕੁੱਲ ਲਗਭਗ 19 MB ਲੱਗਦਾ ਹੈ। ਹਰੇਕ ਕੈਸ਼ ਕੀਤਾ ਜਾਂਦਾ ਹੈ, ਇਸ ਲਈ ਪਹਿਲਾਂ ਵਰਤੀ ਲਿਪੀ 'ਤੇ ਵਾਪਸ ਜਾਣ ਨਾਲ ਕੁਝ ਵੀ ਡਾਊਨਲੋਡ ਨਹੀਂ ਹੁੰਦਾ।
- 3ਹਰ ਲਾਈਨ ਸਿੱਧੀ ਕੀਤੀ ਅਤੇ ਪੜ੍ਹੀ ਜਾਂਦੀ ਹੈਹਰ ਪਛਾਣੀ ਲਾਈਨ ਦੀ ਦਿਸ਼ਾ ਜਾਂਚੀ ਜਾਂਦੀ ਹੈ, ਲੋੜ ਪੈਣ 'ਤੇ ਸਿੱਧਾ ਘੁੰਮਾਈ ਜਾਂਦੀ ਹੈ, ਫਿਰ ਪਛਾਣਕਰਤਾ ਨੂੰ ਭੇਜੀ ਜਾਂਦੀ ਹੈ, ਜੋ ਇਸਨੂੰ ਅੱਖਰ-ਦਰ-ਅੱਖਰ ਪੜ੍ਹਦਾ ਹੈ। ਪੜ੍ਹਨ ਦਾ ਕ੍ਰਮ ਬਾਅਦ ਵਿੱਚ ਦੁਬਾਰਾ ਬਣਾਇਆ ਜਾਂਦਾ ਹੈ, ਉੱਪਰ ਤੋਂ ਹੇਠਾਂ ਅਤੇ ਖੱਬੇ ਤੋਂ ਸੱਜੇ, ਤਾਂ ਜੋ ਆਉਟਪੁੱਟ ਉਸ ਲੇਆਊਟ ਨਾਲ ਮੇਲ ਖਾਵੇ ਜੋ ਤੁਸੀਂ ਦੇਖ ਸਕਦੇ ਹੋ, ਨਾ ਕਿ ਉਸ ਕ੍ਰਮ ਨਾਲ ਜਿਸ ਵਿੱਚ ਡਿਟੈਕਟਰ ਨੂੰ ਬਾਕਸ ਮਿਲੇ।
- 4ਟੈਕਸਟ ਬਾਕਸਾਂ ਅਤੇ ਭਰੋਸੇ ਨਾਲ ਵਾਪਸ ਆਉਂਦਾ ਹੈਹਰ ਲਾਈਨ ਇੱਕ ਭਰੋਸਾ ਸਕੋਰ ਅਤੇ ਉਹ ਕੋਆਰਡੀਨੇਟ ਰੱਖਦੀ ਹੈ ਜਿੱਥੋਂ ਇਹ ਆਈ, ਤਾਂ ਜੋ ਤੁਸੀਂ ਬਿਲਕੁਲ ਦੇਖ ਸਕੋ ਕਿ ਕਿੱਥੋਂ ਕੀ ਪੜ੍ਹਿਆ ਗਿਆ, ਅਤੇ ਉਹ ਸਥਿਤੀਆਂ ਰੱਖਣ ਵਾਲਾ hOCR ਐਕਸਪੋਰਟ ਕਰੋ। ਸਾਫ਼, ਉੱਚ-ਕੰਟ੍ਰਾਸਟ ਟੈਕਸਟ 90% ਤੋਂ ਵੱਧ ਸਕੋਰ ਕਰਦਾ ਹੈ; ਘੱਟ ਰੈਜ਼ੋਲੂਸ਼ਨ, ਚਮਕ ਅਤੇ ਹੱਥ-ਲਿਖਤ ਇਸਨੂੰ ਘਟਾਉਂਦੇ ਹਨ।
ਤੁਹਾਡੀਆਂ ਤਸਵੀਰਾਂ ਤੁਹਾਡੀ ਡਿਵਾਈਸ 'ਤੇ ਰਹਿੰਦੀਆਂ ਹਨ - ਪ੍ਰੋਸੈਸਿੰਗ ਲਈ ਅਸਥਾਈ ਤੌਰ 'ਤੇ ਵੀ ਅੱਪਲੋਡ ਨਹੀਂ ਹੁੰਦੀਆਂ। ਮਾਡਲ ਫਾਈਲਾਂ ਖੁਦ ਸਾਡੇ ਆਪਣੇ ਸਰਵਰ ਤੋਂ ਡਾਊਨਲੋਡ ਹੁੰਦੀਆਂ ਹਨ, ਕਦੇ ਵੀ ਕਿਸੇ ਤੀਜੀ-ਧਿਰ CDN ਤੋਂ ਨਹੀਂ। ID ਦਸਤਾਵੇਜ਼ਾਂ, ਇਕਰਾਰਨਾਮਿਆਂ, ਮੈਡੀਕਲ ਕਾਗਜ਼ਾਤ, ਜਾਂ ਕਿਸੇ ਵੀ ਸੰਵੇਦਨਸ਼ੀਲ ਟੈਕਸਟ ਲਈ ਸੁਰੱਖਿਅਤ।
ਸੰਬੰਧਿਤ ਟੂਲ
ਵੀਡੀਓ ਫਰੇਮ ਗ੍ਰੈਬਰ
ਵੀਡੀਓ ਦੇ ਕਿਸੇ ਵੀ ਫਰੇਮ ਤੋਂ ਪੂਰੇ ਰੈਜ਼ੋਲਿਊਸ਼ਨ 'ਤੇ ਸਥਿਰ ਚਿੱਤਰ ਕੈਪਚਰ ਕਰੋ। ਸਕ੍ਰੱਬ ਕਰੋ, ਫਰੇਮ-ਦਰ-ਫਰੇਮ ਵਧੋ, ਅਤੇ PNG ਜਾਂ JPG ਵਜੋਂ ਸੇਵ ਕਰੋ। ਤੁਰੰਤ ਅਤੇ ਪੂਰੀ ਤਰ੍ਹਾਂ ਤੁਹਾਡੇ ਬ੍ਰਾਊਜ਼ਰ ਵਿੱਚ।
ਇਮੇਜ ਸਟੈਗਨੋਗ੍ਰਾਫੀ (ਤਸਵੀਰ ਵਿੱਚ ਟੈਕਸਟ ਲੁਕਾਓ)
least-significant-bit ਸਟੈਗਨੋਗ੍ਰਾਫੀ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਇੱਕ PNG ਦੇ ਅੰਦਰ ਇੱਕ ਗੁਪਤ ਟੈਕਸਟ ਸੁਨੇਹਾ ਲੁਕਾਓ, ਨਾਲ ਵਿਕਲਪਿਕ AES-256-GCM ਪਾਸਵਰਡ ਐਨਕ੍ਰਿਪਸ਼ਨ। ਬਾਅਦ ਵਿੱਚ ਉਸੇ ਟੂਲ ਨਾਲ ਇਸਨੂੰ ਕੱਢੋ। ਸਭ ਕੁਝ ਤੁਹਾਡੇ ਬ੍ਰਾਊਜ਼ਰ ਵਿੱਚ ਚੱਲਦਾ ਹੈ।
ਚਿੱਤਰ ਰੰਗ ਪੈਲੇਟ ਐਕਸਟ੍ਰੈਕਟਰ
k-means ਰੰਗ ਕੁਆਂਟਾਈਜ਼ੇਸ਼ਨ ਵਰਤਦੇ ਹੋਏ ਕਿਸੇ ਵੀ ਚਿੱਤਰ ਤੋਂ ਪ੍ਰਮੁੱਖ ਰੰਗ ਕੱਢੋ। ਆਪਣੀ ਫੋਟੋ ਜਾਂ ਲੋਗੋ ਦੇ ਚੋਟੀ ਦੇ 2-16 ਰੰਗਾਂ ਲਈ ਹੈਕਸ ਕੋਡ ਪ੍ਰਾਪਤ ਕਰੋ।