Konvertues HTML në Markdown Falas

Konvertoni HTML në Markdown të pastër. Trajton titujt, listat, lidhjet, imazhet, blloqet e kodit dhe citimet. Perfekt për zhvendosjen e përmbajtjes jashtë CMS-ve.

Funksionon jashtë linje sapo ngarkohet

Ngjit HTML-in në të majtë; Markdown-i i pastër shfaqet në të djathtë. Markdown-i është më i thjeshtë se HTML-i, kështu që stilizimi, skriptet dhe tabelat komplekse thjeshtohen ose hiqen.

Këshillë: ngjitni tekst të formatuar të kopjuar nga një faqe web, Word, ose Google Docs - HTML-i i tij kapet automatikisht.

Rezultati Markdown
Rezultati Markdown do të shfaqet këtu…

Si funksionon

Ky konvertues është ndërtuar rreth një tubacioni regex të shkruar me dorë, pa varësi — nuk importohet asnjë bibliotekë e palës së tretë. I gjithë konvertimi funksionon brenda shfletuesit tënd përmes një thirrjeje React useMemo, duke përditësuar daljen drejtpërdrejt ndërsa shkruan.

  1. 1
    Zbulimi i ngjitjes kap tekstin e pasur
    Një trajtues ClipboardEvent lexon aromën text/html nga clipboard para se shfletuesi të mund të ngjisë tekst të thjeshtë. Kjo do të thotë që ngjitja direkt nga një faqe web, Google Docs, ose Word e kap automatikisht markup-in e papërpunuar HTML — nuk të duhet të shohësh burimin së pari.
  2. 2
    Tubacioni regex me shumë kalime heq dhe konverton etiketat
    Konvertuesi xhiron një renditje të rreptë kalimesh regex: fillimisht heq <head>, <script>, <style>, dhe komentet HTML, pastaj i fsheh blloqet e kodit të tërhequr pas vendmbajtësesh me bajt zero për të parandaluar kalimet e mëvonshme nga dëmtimi i përmbajtjes së kodit. Kalimet pasuese trajtojnë titujt (h1–h6), citimet blloku, imazhet, lidhjet, të trasha/italike/vijëzuara, listat e renditura dhe të parenditura, dhe tabela bazë GFM me pipe — çdo kalim synon një familje specifike etiketash.
  3. 3
    Dekodifikim entitetesh dhe normalizim hapësirash
    Pasi hiqen të gjitha etiketat, një funksion i dedikuar decodeEntities zgjidh entitetet e emërtuara (&amp;, &lt;, etj.) plus referencat numerike dhjetore dhe heksadecimale të karaktereve (&#39;, &#x27;) duke përdorur String.fromCodePoint. Pikëkodet e keqformuara ose jashtë intervalit zëvendësohen me karakterin e zëvendësimit Unicode në vend që të hedhin gabim. Hapësirat pasuese, sekuencat e shpalosura të rreshtave bosh, dhe hapësirat e tepërta normalizohen pastaj.
  4. 4
    Segmentet e mbrojtura të kodit rikthehen
    Sistemi i vendmbajtëseve (indekse të ndara me bajt zero) shpalos i fundit, pasi heqja, dekodifikimi, dhe shpalosja e hapësirave janë të përfunduara. Kjo parandalon sekuencat e entiteteve brenda literaleve të kodit nga dekodifikimi dy herë — një gabim i zakonshëm dyfish-dekodimi në konvertuesit naivë HTML-në-Markdown.

Mjete të ngjashme

Pyetjet e bëra më shpesh