Comment convertir du HTML en Markdown
Collez un extrait HTML, lancez sa conversion, puis examinez le texte de style Markdown obtenu. Les formes prises en charge sont transformées, tandis qu’une variante non reconnue peut demander une retouche manuelle.
Avant de transformer votre extrait
Cet outil transforme un extrait HTML fourni en texte de style Markdown. Il peut être utile pour reprendre une structure lisible dans une documentation, un éditeur Markdown ou un contenu à relire. La conversion repose sur des transformations ciblées : elle prend en charge certaines balises, certains attributs, des entités définies et des formes précises d’espacement, sans couvrir toutes les variantes du HTML.
Le champ de saisie est facultatif et prend par défaut une chaîne vide. Si vous ne renseignez aucun contenu, l’opération se termine correctement avec un résultat converti vide. Pour un document réel, préparez l’extrait dont la structure vous intéresse et gardez en tête que des différences d’attributs, d’imbrication ou de balises peuvent modifier le résultat.
Avant de commencer, repérez les éléments à contrôler après la conversion : titres, liens, images, emphase, listes, citations et code. Cette préparation facilite la comparaison entre le texte source et la sortie obtenue, sans supposer que chaque détail visuel sera reproduit.
Lancer la conversion et vérifier les éléments
- Sélectionnez l’extrait HTML à traiter, en conservant ses balises et son contenu.
- Collez le texte dans le champ prévu par l’outil.
- Lancez la conversion avec le contrôle proposé dans l’interface.
- Lisez la sortie et comparez-la avec l’extrait avant de la reprendre dans un document Markdown.
Les titres de niveau 1 à 6 reçoivent des préfixes de titre Markdown, tandis que leur texte intérieur est conservé. Les liens possédant un attribut href entouré de guillemets simples ou doubles sont convertis en liens Markdown. Les images dotées d’un attribut src entre guillemets doubles peuvent devenir des images Markdown ; dans la forme reconnue, le texte alternatif est utilisé lorsqu’il apparaît après src, et il peut rester vide dans les autres cas prévus.
Les éléments strong, b, em et i sans attribut deviennent des marqueurs d’emphase. La structure nue pre contenant code peut produire un bloc de code clôturé, tandis qu’un élément code correspondant au motif prévu peut donner du code en ligne. Certaines formes de listes, citations, paragraphes, retours à la ligne, règles horizontales et conteneurs reçoivent également une mise en forme ou un espacement de style Markdown.
Après ces transformations, la syntaxe des balises restantes correspondant au motif traité est retirée, mais le texte qu’elles entourent est conservé. Certaines entités nommées et références numériques décimales sont décodées. Les suites d’au moins quatre retours à la ligne sont ensuite réduites à trois, puis les espaces placés au début et à la fin de la sortie sont supprimés.
Évaluer la sortie avant réutilisation
La sortie est un texte de style Markdown, pas une reproduction garantie de chaque détail du HTML d’origine. Une variante d’attribut, de structure ou d’imbrication peut empêcher une transformation ciblée ; une balise peut alors rester sous une forme inattendue ou perdre sa syntaxe sans recevoir l’équivalent Markdown souhaité. Relisez la sortie en vous aidant de l’extrait source.
Commencez par contrôler la hiérarchie des titres, les destinations des liens et le texte alternatif des images. Vérifiez ensuite les marqueurs d’emphase, la séparation des listes, les citations et les délimitations des blocs de code. Examinez aussi les espaces extérieurs et les groupes de retours à la ligne, car ces éléments sont normalisés à la fin de l’opération.
Les références numériques décimales méritent une vérification distincte. Lorsqu’une référence contient uniquement des chiffres entre &# et ;, sa valeur est transmise à la conversion de caractères. Une valeur située hors de la plage acceptée peut faire échouer l’opération, alors qu’une forme malformée peut rester inchangée. Si le texte contient ce type de référence, recherchez-la lorsque la sortie ne correspond pas à votre attente.
Exemple pratique
Vous préparez une courte documentation et souhaitez retrouver son titre, son lien et sa commande sous des formes Markdown contrôlables.
Collez <h2>Documentation</h2><p>Voir <a href="documentation">la page</a>.</p><pre><code>npm install</code></pre>, lancez la conversion, puis observez ces trois formes dans le texte obtenu.
La sortie doit présenter un titre avec un préfixe Markdown, un lien dans une syntaxe Markdown et un bloc de code clôturé si les structures correspondantes sont reconnues.
Limites
- La conversion dépend de motifs HTML ciblés ; les différences d’attributs, d’imbrication ou de structure doivent donc être vérifiées dans la sortie.
Erreurs fréquentes
- Une balise enrichie d’attributs ou placée dans une imbrication différente peut ne pas correspondre au motif prévu. Simplifiez sa structure lorsque c’est possible, relancez la conversion, puis corrigez manuellement les éléments qui restent à vérifier.
Questions fréquentes
Que se passe-t-il si je ne saisis aucun HTML ?
Lorsque le champ est vide ou omis, l’opération se termine correctement avec un résultat converti vide. Dès qu’un extrait est fourni, il est traité selon les structures reconnues.
Les titres HTML sont-ils convertis ?
Les éléments de niveau 1 à 6 deviennent des préfixes de titre Markdown et gardent leur texte intérieur. Vérifiez ensuite l’ordre des niveaux dans votre document.
Les entités HTML sont-elles toujours décodées ?
Une valeur numérique hors de la plage acceptée peut toutefois faire échouer l’opération, tandis qu’une forme malformée peut rester inchangée.