ఉచిత HTML నుండి Markdown కన్వర్టర్

HTMLను క్లీన్ Markdownగా మార్చండి. హెడింగ్‌లు, జాబితాలు, లింక్‌లు, చిత్రాలు, కోడ్ బ్లాక్‌లు, మరియు బ్లాక్‌కోట్‌లను నిర్వహిస్తుంది. CMSల నుండి కంటెంట్‌ను బయటకు తరలించడానికి అనువైనది.

లోడ్ అయిన తర్వాత ఆఫ్‌లైన్‌లో పనిచేస్తుంది

ఎడమ వైపు HTMLను పేస్ట్ చేయండి; కుడి వైపు శుభ్రమైన Markdown కనిపిస్తుంది. HTML కంటే Markdown సరళమైనది, కాబట్టి స్టైలింగ్, స్క్రిప్ట్‌లు, మరియు సంక్లిష్ట పట్టికలు సరళీకరించబడతాయి లేదా తొలగించబడతాయి.

చిట్కా: వెబ్ పేజీ, Word లేదా Google Docs నుండి కాపీ చేసిన రిచ్ టెక్స్ట్‌ను పేస్ట్ చేయండి - దాని HTML స్వయంచాలకంగా క్యాప్చర్ అవుతుంది.

Markdown అవుట్‌పుట్
Markdown అవుట్‌పుట్ ఇక్కడ కనిపిస్తుంది…

ఇది ఎలా పనిచేస్తుంది

ఈ కన్వర్టర్ చేతితో రాసిన, సున్నా-డిపెండెన్సీ regex పైప్‌లైన్ చుట్టూ నిర్మించబడింది — ఏ థర్డ్-పార్టీ లైబ్రరీ దిగుమతి చేయబడదు. మొత్తం మార్పిడి React useMemo కాల్ ద్వారా మీ బ్రౌజర్‌లో నడుస్తుంది, మీరు టైప్ చేస్తుండగా అవుట్‌పుట్‌ను లైవ్‌గా అప్‌డేట్ చేస్తుంది.

  1. 1
    పేస్ట్ గుర్తింపు రిచ్ టెక్స్ట్‌ను అడ్డగిస్తుంది
    బ్రౌజర్ సాదా టెక్స్ట్ అతికించే ముందే ClipboardEvent హ్యాండ్లర్ క్లిప్‌బోర్డ్ నుండి text/html రూపాన్ని చదువుతుంది. అంటే వెబ్ పేజీ, Google Docs, లేదా Word నుండి నేరుగా అతికిస్తే ముడి HTML మార్కప్ స్వయంచాలకంగా పట్టుకోబడుతుంది — ముందుగా source చూడాల్సిన అవసరం లేదు.
  2. 2
    బహుళ-పాస్ regex పైప్‌లైన్ ట్యాగ్‌లను తీసేసి మారుస్తుంది
    కన్వర్టర్ regex పాస్‌లను కఠినమైన క్రమంలో నడుపుతుంది: ముందుగా <head>, <script>, <style>, మరియు HTML కామెంట్‌లను తీసివేస్తుంది, తర్వాతి పాస్‌లు కోడ్ విషయాన్ని పాడుచేయకుండా fenced code blocksను null-byte placeholders వెనుక దాచిపెడుతుంది. తర్వాతి పాస్‌లు headings (h1–h6), blockquotes, చిత్రాలు, లింక్‌లు, bold/italic/strikethrough, ordered మరియు unordered జాబితాలు, మరియు ప్రాథమిక GFM pipe పట్టికలను నిర్వహిస్తాయి — ప్రతి పాస్ నిర్దిష్ట ట్యాగ్ కుటుంబాన్ని లక్ష్యంగా చేసుకుంటుంది.
  3. 3
    Entity డీకోడింగ్ మరియు ఖాళీ నార్మలైజేషన్
    అన్ని ట్యాగ్‌లు తీసివేసిన తర్వాత, ప్రత్యేక decodeEntities ఫంక్షన్ String.fromCodePoint ఉపయోగించి named entities (&amp;, &lt;, మొదలైనవి) మరియు సంఖ్యా దశాంశ మరియు hex character references (&#39;, &#x27;)ను పరిష్కరిస్తుంది. తప్పుగా ఏర్పడిన లేదా పరిధి-వెలుపలి code points లోపం ఇవ్వకుండా Unicode replacement characterతో భర్తీ చేయబడతాయి. తర్వాత చివరి ఖాళీలు, ఖాళీ లైన్‌ల వరుసలు, మరియు అదనపు ఖాళీలు నార్మలైజ్ చేయబడతాయి.
  4. 4
    రక్షిత కోడ్ భాగాలు పునరుద్ధరించబడతాయి
    placeholder వ్యవస్థ (null-byte-విభజిత సూచికలు) తీసివేత, డీకోడింగ్, మరియు ఖాళీ కుదింపు పూర్తయిన తర్వాత చివరగా విప్పబడుతుంది. ఇది కోడ్ లిటరల్స్ లోపల entity శ్రేణులు రెండుసార్లు డీకోడ్ కాకుండా నిరోధిస్తుంది — సాధారణ HTML-to-Markdown కన్వర్టర్‌లలో కనిపించే double-decode బగ్.

సంబంధిత సాధనాలు

తరచుగా అడిగే ప్రశ్నలు