HTML Entity Encoder/Decoder
This tool allows you to convert text with special characters to HTML entities and vice versa. HTML entities help display special characters correctly on web pages.
Mode
<
<
Less than sign
>
>
Greater than sign
&
&
Ampersand
"
"
Double quotation mark
'
'
Single quotation mark
©
©
Copyright symbol
®
®
Registered trademark
Comment utiliser Encodeur/Décodeur d'Entités HTML
- 1
Saisissez votre texte
Collez le texte ou l'extrait HTML à convertir dans la zone de saisie.
- 2
Choisissez encoder ou décoder
Cliquez sur Encoder pour transformer les caractères spéciaux en entités HTML, ou sur Décoder pour reconvertir les entités en caractères.
- 3
Obtenez le résultat
La sortie convertie apparaît instantanément dans le panneau de résultat.
- 4
Copiez la sortie
Utilisez Copier le résultat pour récupérer le texte encodé ou décodé pour votre projet.
Un guide pratique des entités HTML
Ce qu'est une entité HTML
Une entité HTML, plus formellement une référence de caractère, est un code court qui remplace un seul caractère en HTML. Chaque entité commence par une esperluette (&) et se termine par un point-virgule (;). Les entités vous permettent d'inclure des caractères que le navigateur interpréterait autrement à tort comme du balisage, des caractères difficiles à taper, ou des caractères absents de votre clavier, tout en gardant le fichier source en ASCII pur.
Les entités comptent pour deux raisons distinctes. D'abord, quelques caractères sont réservés par le HTML lui-même et doivent être échappés pour s'afficher correctement. Ensuite, le vaste monde des symboles, lettres accentuées, signes monétaires, flèches et emojis peut être écrit de façon fiable sous forme de références, quel que soit l'encodage du fichier. Cet outil encode des caractères en entités et décode des entités vers les caractères qu'elles représentent.
Références nommées et numériques
Il existe deux façons d'écrire une entité, et elles sont interchangeables quant à ce qu'elles produisent. Une référence nommée utilise une étiquette lisible par l'humain, comme © pour le signe de copyright, & pour une esperluette, ou pour une espace insécable. Le HTML définit une liste fixe de ces noms, donc seuls les caractères dotés d'un nom attribué peuvent s'écrire ainsi.
Une référence numérique utilise le point de code Unicode du caractère au lieu d'un nom, et elle peut représenter n'importe quel caractère. La forme décimale est une esperluette, un dièse, le point de code en base 10 et un point-virgule — par exemple ©. La forme hexadécimale ajoute un x après le dièse et donne le point de code en base 16 — par exemple ©. Les trois formes ©, © et © affichent le symbole © identique, car 169 en décimal égale A9 en hexadécimal égale le point de code du copyright.
Les cinq qui doivent toujours être échappés
La plupart des caractères sont facultatifs à encoder, mais un petit groupe est de fait obligatoire dans le source HTML. L'esperluette & (&) doit être échappée car elle débute chaque entité ; laissez-la brute à côté d'un mot et le navigateur peut tenter d'analyser une entité inexistante. Le signe inférieur < (<) et le signe supérieur > (>) doivent être échappés dans le texte car ils délimitent les balises. À l'intérieur des valeurs d'attribut, le guillemet double " (") et l'apostrophe ' (') doivent être échappés pour ne pas fermer l'attribut prématurément.
Tout le reste est une commodité. Vous pouvez écrire é directement dans un fichier UTF-8 ou sous la forme é ou é — toutes sont valides. Les cinq caractères réservés sont différents : se tromper produit un balisage cassé ou, avec une entrée non fiable, une faille de cross-site scripting, ce sont donc les caractères que vous ne devez jamais laisser non échappés au mauvais endroit.
Exemple concret : symboles et accents
Supposons que vous vouliez qu'un pied de page affiche « © 2026 Café Ünïcode — 100% safe ». Plusieurs de ces caractères ne sont pas de l'ASCII pur. Le signe de copyright peut s'écrire © ou ©. Le é de Café est é ou é, et le Ü est Ü ou Ü. Le tiret cadratin — est — ou —, et l'espace insécable qui maintient « 100% » ensemble est .
Encoder la chaîne entière donne quelque chose comme © 2026 Café Ünïcode — 100% safe, ce qui est garanti de s'afficher à l'identique quelle que soit la configuration de l'encodage de la page. Le décoder ici inverse le processus et vous restitue la ligne lisible avec les vrais symboles en place.
Choisir entre nommé et numérique
Les entités nommées l'emportent en lisibilité. © et — indiquent à un futur lecteur exactement de quel caractère il s'agit, ce qui rend le source plus facile à maintenir qu'un mur de codes numériques. Le compromis est la couverture : seuls les caractères dotés d'un nom attribué peuvent s'écrire par leur nom, et la liste, bien que vaste, n'inclut pas tout.
Les références numériques l'emportent en universalité et en précision. Comme elles désignent directement le point de code Unicode, elles peuvent encoder n'importe quel caractère existant, y compris ceux sans nom et y compris les emojis. Elles sont aussi sans ambiguïté, ce qui est commode quand vous devez être sûr d'un symbole obscur. Une pratique courante consiste à utiliser les entités nommées pour la poignée de caractères familiers (©, &, , —) et les références numériques pour tout ce qui est exotique.
Emojis et caractères au-delà de la plage de base
Les emojis et de nombreux symboles se situent haut dans la plage Unicode, au-dessus des valeurs qu'une seule unité de code à l'ancienne peut contenir, mais les références numériques les gèrent proprement car elles se contentent de nommer le point de code. L'emoji visage souriant a le point de code U+1F600, il peut donc s'écrire sous la référence décimale 😀 ou la référence hexadécimale 😀, qui produisent toutes deux le même glyphe.
En pratique, enregistrer votre fichier en UTF-8 et coller l'emoji directement est généralement plus simple et tout aussi correct. Les références numériques prennent de la valeur quand on ne peut pas faire confiance à une chaîne de traitement pour préserver les octets bruts — un gabarit d'e-mail, un système qui aplatit en ASCII, ou un contexte où vous voulez consigner le point de code exact sans ambiguïté. Dans tous les cas, le caractère qui apparaît est entièrement déterminé par son point de code.
Décoder du texte d'entités illisible
Une tâche très courante dans la vraie vie est de nettoyer un texte qui arrive truffé de codes d'entités visibles. Vous copiez un paragraphe depuis une page web ou un export de base de données et, au lieu de la ponctuation normale, vous voyez &, ', " et ’ disséminés un peu partout. Cela signifie que le texte a été encodé en HTML quelque part en amont et jamais décodé pour l'affichage. Le coller dans le mode Décoder ici retransforme ces références en vrais caractères &, ', " et l'apostrophe typographique.
Méfiez-vous du double encodage, la situation où le texte a été échappé deux fois et où vous voyez des séquences comme &amp; ou &#39;. Ici, les caractères littéraux &amp; doivent devenir & puis &, le remède est donc de décoder plus d'une fois jusqu'à ce qu'il ne reste plus d'entités. Si une seule passe de décodage laisse encore & dans votre résultat, repassez le résultat par Décoder pour retirer la deuxième couche.
Pièges courants
L'erreur la plus fréquente est le point-virgule manquant. Une entité n'est valide que lorsqu'elle est terminée, donc © sans point-virgule peut ne pas s'afficher comme le signe de copyright. Une erreur connexe est d'encoder l'esperluette en dernier au lieu d'en premier lorsqu'on échappe à la main, ce qui transforme vos autres entités en texte littéral comme &lt;.
Rappelez-vous aussi que les entités sont un concept HTML, pas une barrière de sécurité à elles seules. Encoder une entrée non fiable en entités fait partie de la prévention du balisage cassé et du XSS, mais cela doit se faire dans le bon contexte et au moment de la sortie, sans s'y fier comme remède universel. Enfin, n'encodez pas des caractères qui n'en ont pas besoin dans du contenu ordinaire — le surencodage rend le source plus difficile à lire et n'apporte aucun bénéfice quand le fichier est déjà en UTF-8.
Questions fréquentes
Que sont les entités HTML et pourquoi les utiliser ?
Quels caractères l'encodeur convertit-il ?
Puis-je reconvertir les entités en caractères normaux ?
Est-ce utile pour éviter un HTML cassé ou les attaques XSS ?
Mon texte est-il envoyé à un serveur ?
Outils similaires
Continuez avec ces outils pratiques