LibraTool logoLibraTool

Бесплатен Конвертор HTML во Markdown

Конвертирајте HTML во чист Markdown. Ракува со наслови, листи, врски, слики, блокови код и цитати. Совршено за преместување содржина надвор од CMS системи.

Работи офлајн откако ќе се вчита

Вметнете HTML лево; чист Markdown се појавува десно. Markdown е поедноставен од HTML, па стиловите, скриптите и сложените табели се поедноставуваат или отфрлаат.

Совет: залепете форматиран текст копиран од веб-страница, Word или Google Docs - неговиот HTML се зема автоматски.

Markdown резултат
Markdown резултатот ќе се појави тука…

Како функционира

Овој конвертор е изграден околу рачно напишан цевковод со регуларни изрази без зависности — не е увезена библиотека од трета страна. Целата конверзија работи внатре во вашиот прелистувач преку React повик useMemo, ажурирајќи го излезот во живо додека пишувате.

  1. 1
    Откривањето на залепување го пресретнува богатиот текст
    Обработувач на ClipboardEvent го чита варијантот text/html од клипбордот пред прелистувачот да може да залепи обичен текст. Ова значи дека залепувањето директно од веб-страница, Google Docs или Word автоматски ја фаќа суровата HTML ознака — не треба прво да го видите изворниот код.
  2. 2
    Цевководот со повеќе проходи на регуларен израз ги отстранува и конвертира ознаките
    Конверторот извршува строг редослед на проходи со регуларни изрази: прво отстранува <head>, <script>, <style> и HTML коментари, потоа ги складира оградените блокови код зад заменски знаци со нула-бајт за да спречи подоцнежните проходи да ја оштетат содржината на кодот. Наредните проходи ракуваат со наслови (h1–h6), цитати, слики, врски, задебелено/курзив/прецртано, подредени и неподредени листи, и основни GFM табели со вертикална црта — секој проход е насочен кон конкретно семејство ознаки.
  3. 3
    Декодирање единки и нормализирање празни места
    По отстранувањето на сите ознаки, наменска функција decodeEntities ги разрешува именуваните единки (&amp;, &lt;, итн.) плус нумеричките децимални и хекс референци на карактери (&#39;, &#x27;) користејќи String.fromCodePoint. Погрешно формирани или кодни точки надвор од опсег се заменуваат со Unicode заменски карактер наместо да предизвикаат грешка. Завршните празни места, собраните низи празни редови, и вишокот празни места потоа се нормализираат.
  4. 4
    Заштитените делови со код се враќаат
    Системот на заменски знаци (индекси разделени со нула-бајт) се одвиткува последен, откако отстранувањето, декодирањето и собирањето празни места се завршени. Ова спречува секвенците на единки внатре во буквални делови код да се декодираат двапати — вообичаена грешка на двојно декодирање во наивни конвертори од HTML во Markdown.

Поврзани алатки

Најчесто поставувани прашања