Encodeur et décodeur d'entités HTML
Échappez du texte en entités HTML, ou reconvertissez des entités en texte brut. Nommées, décimales ou hexadécimales, le tout dans votre navigateur et sans rien envoyer.
À quoi sert cet outil
Collez du texte et récupérez-le échappé en références de caractères HTML, ou collez des références et récupérez votre texte. À l'encodage, vous pouvez rester au minimum en ne touchant que les cinq caractères qui cassent vraiment le balisage, ou couvrir tout ce qui dépasse l'ASCII de base pour ces anciens systèmes auxquels on n'ose toujours pas confier un jeu de caractères. Vous choisissez aussi comment chaque référence est écrite : un nom lisible comme —, un nombre décimal ou de l'hexadécimal. Les emoji et les autres caractères hors du domaine de base sont traités par point de code, donc ils ressortent en une seule référence propre plutôt qu'en deux moitiés cassées. Le décodage est volontairement prudent : ce qu'il ne reconnaît pas vous est rendu exactement tel qu'il est arrivé, jamais remplacé en douce. Tout tourne dans votre navigateur, sans bibliothèque à télécharger et sans que rien ne quitte votre appareil.
À quoi ça vous sert
- Échapper un bloc de texte avant de le poser dans un gabarit HTML ou un email.
- Lire le source d'une page ou une réponse d'API remplie de & et de ’.
- Rendre un texte sûr pour un attribut HTML, pour qu'un guillemet égaré ne casse pas la balise.
- Préparer du contenu pour un système ancien qui n'accepte que de l'ASCII brut.
- Vérifier quel caractère se cache vraiment derrière quelque chose en voyant son point de code.
Comment l'utiliser
- Choisissez Encoder pour échapper du texte, ou Décoder pour reconvertir des références en texte.
- Collez ou tapez dans la zone et regardez le résultat se mettre à jour au fil de la frappe.
- À l'encodage, décidez si vous échappez seulement les caractères de balisage ou tout ce qui dépasse l'ASCII.
- Choisissez nommé, décimal ou hexadécimal pour la façon d'écrire chaque référence.
- Copiez le résultat avec le bouton de copie.
Tout le travail se passe dans votre navigateur. Aucun fichier n'est envoyé à un serveur. Voir plus d'outils dans le même champ.
Autres outils du même champ
DéveloppementEncodeur / decodeur d'URL et editeur de query string
Encodez ou decodez vos URLs comme il faut, avec un choix explicite entre l'echappement de composant et celui d'URI complete, et modifiez n'importe quelle query string sous forme de tableau de paires cle et valeur. Tout tourne dans votre navigateur, rien n'est televerse.
Encoder et Décoder du Base64
Encodez et décodez du texte en Base64 en ligne, avec un alphabet URL-safe en option. Tout dans votre navigateur, rien n'est envoyé.
Formater et Valider du JSON
Formatez, validez et minifiez du JSON en ligne. Embellissez un JSON brouillon ou compactez-le en un clic, gratuit et dans votre navigateur.
Testeur de Regex en Ligne
Testez et déboguez vos expressions régulières en ligne en temps réel, avec groupes de capture et correspondances surlignées. Gratuit et privé.
Questions fréquentes
Quelle est la différence avec un encodeur d'URL ?
Ils résolvent des problèmes différents. Les entités HTML protègent le texte qui vit à l'intérieur d'une page, pour qu'une esperluette ou un chevron soient lus comme du contenu et non comme du balisage. L'encodage pourcent protège le texte qui vit à l'intérieur d'une URL, pour qu'une barre oblique ou un point d'interrogation soient lus comme une donnée et non comme une partie de l'adresse. Utiliser l'un à la place de l'autre est une source de bugs très courante, et c'est pour cela que ce sont deux outils distincts ici.
Quels caractères l'option minimale échappe-t-elle ?
Cinq : l'esperluette, les signes inférieur et supérieur, le guillemet double et l'apostrophe. Ce sont les caractères qui peuvent fermer un attribut ou ouvrir une balise, donc les échapper est ce qui évite réellement un balisage cassé. Le reste, accents et emoji compris, reste lisible parce que l'UTF-8 le gère très bien.
Est-ce que ça gère les emoji et les caractères hors du domaine de base ?
Oui. Le texte est parcouru par point de code et non par les unités de 16 bits sous-jacentes, donc un emoji devient une seule référence comme 😀 au lieu de deux moitiés sans signification. C'est le bug classique des encodeurs faits main, et ici l'aller-retour vous rend votre emoji intact.
Que se passe-t-il avec un nom d'entité qu'il ne connaît pas ?
Il reste exactement tel quel. La table de noms couvre les caractères de balisage, tout le bloc Latin-1, la ponctuation et les symboles courants, les flèches, les opérateurs mathématiques et l'alphabet grec, c'est-à-dire ce qu'utilise le contenu réel. Ce qui sort de là est rendu sans y toucher plutôt que transformé en caractère de remplacement, donc le décodage n'abîme jamais votre texte. Les références numériques fonctionnent de toute façon pour n'importe quel caractère Unicode.
Mon texte est-il envoyé quelque part ?
Non. Toute la conversion est de la manipulation de chaînes qui se déroule dans l'onglet de votre navigateur. Rien n'est envoyé à un serveur, donc vous pouvez coller sans crainte du contenu que vous ne confieriez pas à un site.

