LibraTool logoLibraTool

ਮੁਫ਼ਤ HTML ਤੋਂ Markdown ਕਨਵਰਟਰ

HTML ਨੂੰ ਸਾਫ਼ Markdown ਵਿੱਚ ਬਦਲੋ। ਸਿਰਲੇਖ, ਸੂਚੀਆਂ, ਲਿੰਕ, ਚਿੱਤਰ, ਕੋਡ ਬਲਾਕ, ਟੇਬਲ, ਅਤੇ ਬਲਾਕਕੋਟ ਸੰਭਾਲਦਾ ਹੈ। CMS ਵਿੱਚੋਂ ਸਮੱਗਰੀ ਬਾਹਰ ਕੱਢਣ ਲਈ ਸੰਪੂਰਨ।

ਲੋਡ ਹੋਣ ਤੋਂ ਬਾਅਦ ਔਫ਼ਲਾਈਨ ਕੰਮ ਕਰਦਾ ਹੈ

ਖੱਬੇ ਪਾਸੇ HTML ਪੇਸਟ ਕਰੋ; ਸੱਜੇ ਪਾਸੇ ਸਾਫ਼ ਮਾਰਕਡਾਊਨ ਦਿਖਾਈ ਦੇਵੇਗਾ। ਮਾਰਕਡਾਊਨ HTML ਨਾਲੋਂ ਸਰਲ ਹੈ, ਇਸ ਲਈ ਸਟਾਈਲਿੰਗ, ਸਕ੍ਰਿਪਟਾਂ ਅਤੇ ਗੁੰਝਲਦਾਰ ਟੇਬਲਾਂ ਨੂੰ ਸਰਲ ਬਣਾਇਆ ਜਾਂਦਾ ਹੈ ਜਾਂ ਹਟਾਇਆ ਜਾਂਦਾ ਹੈ।

ਸੁਝਾਅ: ਵੈੱਬ ਪੇਜ, Word, ਜਾਂ Google Docs ਤੋਂ ਕਾਪੀ ਕੀਤਾ ਰਿਚ ਟੈਕਸਟ ਪੇਸਟ ਕਰੋ - ਇਸਦੀ HTML ਆਪਣੇ ਆਪ ਕੈਪਚਰ ਹੋ ਜਾਂਦੀ ਹੈ।

ਮਾਰਕਡਾਊਨ ਆਊਟਪੁੱਟ
ਮਾਰਕਡਾਊਨ ਆਊਟਪੁੱਟ ਇੱਥੇ ਦਿਖਾਈ ਦੇਵੇਗਾ…

ਇਹ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ

ਇਹ ਕਨਵਰਟਰ ਹੱਥ ਨਾਲ ਲਿਖੀ, ਬਿਨਾਂ-ਨਿਰਭਰਤਾ regex pipeline 'ਤੇ ਬਣਿਆ ਹੈ — ਕੋਈ ਤੀਜੀ-ਧਿਰ ਲਾਇਬ੍ਰੇਰੀ ਇੰਪੋਰਟ ਨਹੀਂ ਹੁੰਦੀ। ਪੂਰਾ ਬਦਲਾਅ React useMemo call ਰਾਹੀਂ ਤੁਹਾਡੇ ਬ੍ਰਾਊਜ਼ਰ ਅੰਦਰ ਚੱਲਦਾ ਹੈ, ਟਾਈਪ ਕਰਦੇ ਹੀ ਆਉਟਪੁੱਟ ਲਾਈਵ ਅੱਪਡੇਟ ਕਰਦੇ ਹੋਏ।

  1. 1
    ਪੇਸਟ ਪਛਾਣ rich text ਫੜਦੀ ਹੈ
    ਇੱਕ ClipboardEvent handler ਬ੍ਰਾਊਜ਼ਰ ਦੇ ਸਾਦਾ ਟੈਕਸਟ ਪੇਸਟ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ ਕਲਿੱਪਬੋਰਡ ਤੋਂ text/html ਰੂਪ ਪੜ੍ਹਦਾ ਹੈ। ਇਸਦਾ ਮਤਲਬ ਹੈ ਕਿਸੇ ਵੈੱਬ ਪੰਨੇ, Google Docs ਜਾਂ Word ਤੋਂ ਸਿੱਧਾ ਪੇਸਟ ਕਰਨ ਨਾਲ ਕੱਚਾ HTML markup ਆਪਣੇ-ਆਪ ਫੜਿਆ ਜਾਂਦਾ ਹੈ — ਤੁਹਾਨੂੰ ਪਹਿਲਾਂ source ਵੇਖਣ ਦੀ ਲੋੜ ਨਹੀਂ।
  2. 2
    ਬਹੁ-ਪਾਸ regex pipeline tags ਹਟਾਉਂਦੀ ਅਤੇ ਬਦਲਦੀ ਹੈ
    ਕਨਵਰਟਰ regex ਪਾਸਾਂ ਦਾ ਸਖ਼ਤ ਕ੍ਰਮ ਚਲਾਉਂਦਾ ਹੈ: ਪਹਿਲਾਂ ਇਹ <head>, <script>, <style> ਅਤੇ HTML comments ਹਟਾਉਂਦਾ ਹੈ, ਫਿਰ fenced code blocks ਨੂੰ null-byte placeholders ਪਿੱਛੇ ਲੁਕਾਉਂਦਾ ਹੈ ਤਾਂ ਜੋ ਬਾਅਦ ਦੇ ਪਾਸ code ਸਮੱਗਰੀ ਖ਼ਰਾਬ ਨਾ ਕਰਨ। ਅਗਲੇ ਪਾਸ headings (h1–h6), blockquotes, ਚਿੱਤਰ, ਲਿੰਕ, bold/italic/strikethrough, ਕ੍ਰਮਬੱਧ ਅਤੇ ਬਿਨਾਂ-ਕ੍ਰਮ ਸੂਚੀਆਂ, ਅਤੇ ਮੁੱਢਲੀਆਂ GFM pipe ਸਾਰਣੀਆਂ ਸੰਭਾਲਦੇ ਹਨ — ਹਰ ਪਾਸ ਇੱਕ ਖ਼ਾਸ tag ਪਰਿਵਾਰ ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾਉਂਦਾ ਹੈ।
  3. 3
    Entity ਡੀਕੋਡਿੰਗ ਅਤੇ ਖ਼ਾਲੀ-ਥਾਂ ਨਾਰਮਲਾਈਜ਼ੇਸ਼ਨ
    ਸਾਰੇ tags ਹਟਾਉਣ ਤੋਂ ਬਾਅਦ, ਇੱਕ ਖ਼ਾਸ decodeEntities function String.fromCodePoint ਵਰਤ ਕੇ named entities (&amp;, &lt;, ਆਦਿ) ਅਤੇ ਅੰਕੀ decimal ਅਤੇ hex character references (&#39;, &#x27;) ਹੱਲ ਕਰਦਾ ਹੈ। ਖ਼ਰਾਬ ਜਾਂ ਸੀਮਾ ਤੋਂ ਬਾਹਰ code points ਗਲਤੀ ਦੇਣ ਦੀ ਥਾਂ Unicode replacement character ਨਾਲ ਬਦਲੇ ਜਾਂਦੇ ਹਨ। ਫਿਰ ਅੰਤਲੀਆਂ ਸਪੇਸਾਂ, ਲਗਾਤਾਰ ਖ਼ਾਲੀ ਲਾਈਨਾਂ, ਅਤੇ ਵਾਧੂ ਖ਼ਾਲੀ ਥਾਂ ਨਾਰਮਲਾਈਜ਼ ਕੀਤੀ ਜਾਂਦੀ ਹੈ।
  4. 4
    ਸੁਰੱਖਿਅਤ code spans ਬਹਾਲ ਕੀਤੇ ਜਾਂਦੇ ਹਨ
    Placeholder ਪ੍ਰਣਾਲੀ (null-byte ਨਾਲ ਵੱਖ indices) ਸਭ ਤੋਂ ਅਖੀਰ ਵਿੱਚ ਖੋਲ੍ਹੀ ਜਾਂਦੀ ਹੈ, ਹਟਾਉਣ, ਡੀਕੋਡ ਕਰਨ ਅਤੇ ਖ਼ਾਲੀ ਥਾਂ ਸਮੇਟਣ ਤੋਂ ਬਾਅਦ। ਇਹ code literals ਅੰਦਰਲੇ entity ਕ੍ਰਮਾਂ ਨੂੰ ਦੋ ਵਾਰ ਡੀਕੋਡ ਹੋਣ ਤੋਂ ਰੋਕਦਾ ਹੈ — ਸਾਦੇ HTML-to-Markdown ਕਨਵਰਟਰਾਂ ਵਿੱਚ ਇੱਕ ਆਮ double-decode bug।

ਸੰਬੰਧਿਤ ਟੂਲ

ਅਕਸਰ ਪੁੱਛੇ ਜਾਂਦੇ ਸਵਾਲ