मोफत HTML ते Markdown कन्व्हर्टर

HTML ला स्वच्छ Markdown मध्ये रूपांतरित करा. हेडिंग, याद्या, लिंक, इमेज, कोड ब्लॉक आणि टेबल हाताळते. CMS मधून सामग्री बाहेर काढण्यासाठी उत्तम.

एकदा लोड झाल्यावर ऑफलाइन काम करते

डावीकडे HTML पेस्ट करा; उजवीकडे साफ Markdown दिसेल. Markdown हे HTML पेक्षा सोपे आहे, त्यामुळे स्टाइलिंग, स्क्रिप्ट्स आणि गुंतागुंतीचे टेबल सुलभ केले जातात किंवा वगळले जातात.

टीप: वेब पान, Word किंवा Google Docs मधून कॉपी केलेला रिच टेक्स्ट पेस्ट करा - त्याचा HTML आपोआप घेतला जातो.

Markdown आउटपुट
Markdown आउटपुट इथे दिसेल…

हे कसे कार्य करते

हा कन्व्हर्टर गराज-लिहिलेल्या, शून्य-अवलंबित्व regex pipeline भोवती बनवला आहे — कोणतीही थर्ड-पार्टी लायब्ररी इम्पोर्ट केलेली नाही. संपूर्ण रूपांतर React useMemo कॉल द्वारे तुमच्या ब्राउझरमध्ये चालते, तुम्ही टाइप करताच आउटपुट लाइव्ह अपडेट करत.

  1. 1
    Paste शोध rich text अडवतो
    ब्राउझर plain text पेस्ट करण्यापूर्वी ClipboardEvent handler clipboard मधून text/html स्वरूप वाचतो. याचा अर्थ वेब पेज, Google Docs, किंवा Word वरून थेट पेस्ट केल्याने आपोआप कच्चे HTML markup पकडले जाते — तुम्हाला आधी source पाहण्याची गरज नाही.
  2. 2
    बहु-पास regex pipeline tags काढते आणि रूपांतरित करते
    कन्व्हर्टर regex passes ची कडक क्रमवारी चालवतो: प्रथम तो <head>, <script>, <style>, आणि HTML comments काढतो, नंतर पुढील passes code सामग्री गैरवापर करू नयेत यासाठी fenced code blocks ला null-byte placeholders मागे लपवतो. पुढील passes headings (h1–h6), blockquotes, इमेजेस, लिंक्स, bold/italic/strikethrough, ordered आणि unordered lists, आणि मूलभूत GFM pipe tables हाताळतात — प्रत्येक pass विशिष्ट tag कुटुंबाला लक्ष्य करतो.
  3. 3
    Entity डीकोडिंग आणि whitespace नॉर्मलायझेशन
    सर्व tags काढल्यानंतर, एक समर्पित decodeEntities फंक्शन String.fromCodePoint वापरून नामांकित entities (&amp;, &lt;, इ.) तसेच संख्यात्मक दशांश आणि hex अक्षर संदर्भ (&#39;, &#x27;) सोडवतो. विकृत किंवा श्रेणीबाहेरील code points त्रुटी फेकण्याऐवजी Unicode replacement अक्षराने बदलले जातात. ट्रेलिंग जागा, संकुचित रिक्त-ओळींचे गट, आणि अतिरिक्त whitespace नंतर नॉर्मलाइझ केले जातात.
  4. 4
    संरक्षित code spans पुनर्संचयित केले जातात
    placeholder प्रणाली (null-byte-delimited indices) स्ट्रिपिंग, डीकोडिंग, आणि whitespace संकुचन पूर्ण झाल्यावर शेवटी उलगडली जाते. हे code literals आतील entity sequences दोनदा डीकोड होण्यापासून रोखते — साध्या HTML-ते-Markdown कन्व्हर्टरमध्ये सामान्य double-decode बग.

संबंधित साधने

वारंवार विचारले जाणारे प्रश्न