HTML Entity Encoder/Decoder
This tool allows you to convert text with special characters to HTML entities and vice versa. HTML entities help display special characters correctly on web pages.
Mode
<
<
Less than sign
>
>
Greater than sign
&
&
Ampersand
"
"
Double quotation mark
'
'
Single quotation mark
©
©
Copyright symbol
®
®
Registered trademark
Cómo usar Codificador/Decodificador de Entidades HTML
- 1
Introduce tu texto
Pega en el cuadro de entrada el texto o el fragmento de HTML que quieres convertir.
- 2
Elige codificar o decodificar
Haz clic en Codificar para convertir los caracteres especiales en entidades HTML, o en Decodificar para convertir las entidades de nuevo en caracteres.
- 3
Obtén el resultado
La salida convertida aparece al instante en el panel de resultados.
- 4
Copia la salida
Usa Copiar resultado para obtener el texto codificado o decodificado para tu proyecto.
Una guía práctica de las entidades HTML
Qué es una entidad HTML
Una entidad HTML, más formalmente una referencia de carácter, es un código corto que sustituye a un solo carácter en HTML. Cada entidad empieza con un ampersand (&) y termina con un punto y coma (;). Las entidades te permiten incluir caracteres que el navegador interpretaría por error como marcado, caracteres difíciles de escribir o caracteres que no están en tu teclado, todo ello manteniendo el archivo fuente en ASCII puro.
Las entidades importan por dos razones distintas. Primero, unos pocos caracteres están reservados por el propio HTML y deben escaparse para mostrarse correctamente. Segundo, el vasto mundo de símbolos, letras acentuadas, marcas de moneda, flechas y emojis puede escribirse de forma fiable como referencias, sin importar la codificación de texto del archivo. Esta herramienta codifica caracteres en entidades y decodifica las entidades de nuevo en los caracteres que representan.
Referencias con nombre frente a numéricas
Hay dos formas de escribir una entidad, y son intercambiables en lo que producen. Una referencia con nombre usa una etiqueta legible para las personas, como © para el signo de copyright, & para un ampersand o para un espacio de no separación. HTML define una lista fija de estos nombres, así que solo los caracteres con un nombre asignado pueden escribirse de esta manera.
Una referencia numérica usa el punto de código Unicode del carácter en lugar de un nombre, y puede representar cualquier carácter en absoluto. La forma decimal es un ampersand, una almohadilla, el punto de código en base 10 y un punto y coma; por ejemplo ©. La forma hexadecimal añade una x tras la almohadilla y da el punto de código en base 16; por ejemplo ©. Las tres, ©, © y ©, representan el símbolo © idéntico, porque 169 en decimal es igual a A9 en hexadecimal, que es igual al punto de código del copyright.
Los cinco que siempre necesitan escaparse
La mayoría de los caracteres son opcionales de codificar, pero un pequeño grupo es prácticamente obligatorio en el código fuente HTML. El ampersand & (&) debe escaparse porque inicia cada entidad; déjalo en bruto junto a una palabra y el navegador podría intentar analizar una entidad que no está ahí. El signo menor que < (<) y el signo mayor que > (>) deben escaparse en el texto porque delimitan etiquetas. Dentro de los valores de atributo, la comilla doble " (") y el apóstrofo ' (') necesitan escaparse para que no cierren el atributo antes de tiempo.
Todo lo demás es una comodidad. Puedes escribir é directamente en un archivo UTF-8 o como é o é; todas son válidas. Los cinco reservados son distintos: equivocarse con ellos produce marcado roto o, con entrada no confiable, un agujero de cross-site scripting, así que son los caracteres que nunca debes dejar sin escapar en el lugar equivocado.
Ejemplo resuelto: símbolos y acentos
Supón que quieres que un pie de página diga "© 2026 Café Ünïcode — 100% safe". Varios de estos caracteres no son ASCII puro. El signo de copyright puede escribirse como © o ©. La é de Café es é o é, y la Ü es Ü o Ü. La raya em — es — o —, y el espacio de no separación que mantiene junto "100%" es .
Codificar la cadena entera da algo como © 2026 Café Ünïcode — 100% safe, que está garantizado que se mostrará de forma idéntica sin importar cómo esté configurada la codificación de caracteres de la página. Decodificarla aquí invierte el proceso y te devuelve la línea legible con los símbolos reales en su sitio.
Elegir con nombre o numérica
Las entidades con nombre ganan en legibilidad. © y — le dicen a un futuro lector exactamente cuál es el carácter, lo que hace que el código fuente sea más fácil de mantener que un muro de códigos numéricos. La contrapartida es la cobertura: solo los caracteres con un nombre asignado pueden escribirse por nombre, y la lista, aunque amplia, no incluye todo.
Las referencias numéricas ganan en universalidad y precisión. Como direccionan el punto de código Unicode de forma directa, pueden codificar cualquier carácter existente, incluidos los que no tienen nombre y los emojis. Además son inequívocas, lo cual resulta práctico cuando necesitas tener certeza sobre un símbolo poco común. Una práctica habitual es usar entidades con nombre para el puñado de las familiares (©, &, , —) y referencias numéricas para cualquier cosa exótica.
Emojis y caracteres más allá del rango básico
Los emojis y muchos símbolos viven en lo alto del rango Unicode, por encima de los valores que una sola unidad de código al estilo antiguo puede contener, pero las referencias numéricas los gestionan con limpieza porque simplemente nombran el punto de código. El emoji de cara sonriente tiene el punto de código U+1F600, así que puede escribirse como la referencia decimal 😀 o la referencia hexadecimal 😀, y ambas producen el mismo glifo.
En la práctica, guardar tu archivo como UTF-8 y pegar el emoji directamente suele ser más sencillo e igual de correcto. Las referencias numéricas se vuelven valiosas cuando no se puede confiar en que una cadena de procesamiento preserve los bytes en bruto: una plantilla de correo, un sistema que aplana a ASCII o un contexto donde quieres que el punto de código exacto quede registrado de forma inequívoca. En cualquier caso, el carácter que aparece queda determinado por completo por su punto de código.
Decodificar texto con entidades distorsionado
Una tarea muy común en el mundo real es limpiar texto que llega lleno de códigos de entidad visibles. Copias un párrafo de una página web o de una exportación de base de datos y, en lugar de puntuación normal, ves &, ', " y ’ esparcidos por él. Eso significa que el texto fue codificado en HTML en algún punto anterior y nunca se decodificó para mostrarlo. Pegarlo en el modo Decodificar de aquí convierte esas referencias de nuevo en los caracteres reales &, ', " y el apóstrofo curvo.
Vigila la doble codificación, la situación en la que el texto se escapó dos veces y ves secuencias como &amp; o &#39;. Aquí los caracteres literales &amp; deberían convertirse en & y luego en &, así que la solución es decodificar más de una vez hasta que no queden entidades. Si una sola pasada de decodificación todavía deja & en tu salida, pasa el resultado por Decodificar de nuevo para eliminar la segunda capa.
Errores comunes
El error más frecuente es el punto y coma que falta. Una entidad solo es válida cuando está terminada, así que © sin punto y coma puede que no se represente como el signo de copyright. Un error relacionado es codificar el ampersand el último en lugar del primero al escapar a mano, lo que convierte tus otras entidades en texto literal como &lt;.
Recuerda también que las entidades son un concepto de HTML, no una barrera de seguridad por sí solas. Codificar entradas no confiables en entidades es parte de evitar el marcado roto y el XSS, pero debe hacerse en el contexto correcto y en el momento de la salida, no confiarse como remedio universal. Por último, no codifiques caracteres que no lo necesitan dentro del contenido normal: la sobrecodificación hace que el código fuente sea más difícil de leer y no ofrece ningún beneficio cuando el archivo ya es UTF-8.
Preguntas frecuentes
¿Qué son las entidades HTML y por qué usarlas?
¿Qué caracteres convierte el codificador?
¿Puedo convertir las entidades de nuevo en caracteres normales?
¿Es útil para evitar HTML roto o XSS?
¿Se envía mi texto a un servidor?
Herramientas relacionadas
Sigue trabajando con estas prácticas herramientas