T

Text Machine

Potentes herramientas de texto, en tu navegador

HTML Entity Encoder/Decoder

This tool allows you to convert text with special characters to HTML entities and vice versa. HTML entities help display special characters correctly on web pages.

Mode

Text to Encode
Characters like <, >, &, " and ' will be converted to HTML entities
Encoded HTML
Common HTML Entities

<

&lt;

Less than sign

>

&gt;

Greater than sign

&

&amp;

Ampersand

"

&quot;

Double quotation mark

'

&#39;

Single quotation mark

©

&copy;

Copyright symbol

®

&reg;

Registered trademark

Cómo usar Codificador/Decodificador de Entidades HTML

  1. 1

    Introduce tu texto

    Pega en el cuadro de entrada el texto o el fragmento de HTML que quieres convertir.

  2. 2

    Elige codificar o decodificar

    Haz clic en Codificar para convertir los caracteres especiales en entidades HTML, o en Decodificar para convertir las entidades de nuevo en caracteres.

  3. 3

    Obtén el resultado

    La salida convertida aparece al instante en el panel de resultados.

  4. 4

    Copia la salida

    Usa Copiar resultado para obtener el texto codificado o decodificado para tu proyecto.

Una guía práctica de las entidades HTML

Qué es una entidad HTML

Una entidad HTML, más formalmente una referencia de carácter, es un código corto que sustituye a un solo carácter en HTML. Cada entidad empieza con un ampersand (&) y termina con un punto y coma (;). Las entidades te permiten incluir caracteres que el navegador interpretaría por error como marcado, caracteres difíciles de escribir o caracteres que no están en tu teclado, todo ello manteniendo el archivo fuente en ASCII puro.

Las entidades importan por dos razones distintas. Primero, unos pocos caracteres están reservados por el propio HTML y deben escaparse para mostrarse correctamente. Segundo, el vasto mundo de símbolos, letras acentuadas, marcas de moneda, flechas y emojis puede escribirse de forma fiable como referencias, sin importar la codificación de texto del archivo. Esta herramienta codifica caracteres en entidades y decodifica las entidades de nuevo en los caracteres que representan.

Referencias con nombre frente a numéricas

Hay dos formas de escribir una entidad, y son intercambiables en lo que producen. Una referencia con nombre usa una etiqueta legible para las personas, como &copy; para el signo de copyright, &amp; para un ampersand o &nbsp; para un espacio de no separación. HTML define una lista fija de estos nombres, así que solo los caracteres con un nombre asignado pueden escribirse de esta manera.

Una referencia numérica usa el punto de código Unicode del carácter en lugar de un nombre, y puede representar cualquier carácter en absoluto. La forma decimal es un ampersand, una almohadilla, el punto de código en base 10 y un punto y coma; por ejemplo &#169;. La forma hexadecimal añade una x tras la almohadilla y da el punto de código en base 16; por ejemplo &#xA9;. Las tres, &copy;, &#169; y &#xA9;, representan el símbolo © idéntico, porque 169 en decimal es igual a A9 en hexadecimal, que es igual al punto de código del copyright.

Los cinco que siempre necesitan escaparse

La mayoría de los caracteres son opcionales de codificar, pero un pequeño grupo es prácticamente obligatorio en el código fuente HTML. El ampersand & (&amp;) debe escaparse porque inicia cada entidad; déjalo en bruto junto a una palabra y el navegador podría intentar analizar una entidad que no está ahí. El signo menor que < (&lt;) y el signo mayor que > (&gt;) deben escaparse en el texto porque delimitan etiquetas. Dentro de los valores de atributo, la comilla doble " (&quot;) y el apóstrofo ' (&#39;) necesitan escaparse para que no cierren el atributo antes de tiempo.

Todo lo demás es una comodidad. Puedes escribir é directamente en un archivo UTF-8 o como &eacute; o &#233;; todas son válidas. Los cinco reservados son distintos: equivocarse con ellos produce marcado roto o, con entrada no confiable, un agujero de cross-site scripting, así que son los caracteres que nunca debes dejar sin escapar en el lugar equivocado.

Ejemplo resuelto: símbolos y acentos

Supón que quieres que un pie de página diga "© 2026 Café Ünïcode — 100% safe". Varios de estos caracteres no son ASCII puro. El signo de copyright puede escribirse como &copy; o &#169;. La é de Café es &eacute; o &#233;, y la Ü es &Uuml; o &#220;. La raya em — es &mdash; o &#8212;, y el espacio de no separación que mantiene junto "100%" es &nbsp;.

Codificar la cadena entera da algo como &copy; 2026 Caf&eacute; &Uuml;n&iuml;code &mdash; 100% safe, que está garantizado que se mostrará de forma idéntica sin importar cómo esté configurada la codificación de caracteres de la página. Decodificarla aquí invierte el proceso y te devuelve la línea legible con los símbolos reales en su sitio.

Elegir con nombre o numérica

Las entidades con nombre ganan en legibilidad. &copy; y &mdash; le dicen a un futuro lector exactamente cuál es el carácter, lo que hace que el código fuente sea más fácil de mantener que un muro de códigos numéricos. La contrapartida es la cobertura: solo los caracteres con un nombre asignado pueden escribirse por nombre, y la lista, aunque amplia, no incluye todo.

Las referencias numéricas ganan en universalidad y precisión. Como direccionan el punto de código Unicode de forma directa, pueden codificar cualquier carácter existente, incluidos los que no tienen nombre y los emojis. Además son inequívocas, lo cual resulta práctico cuando necesitas tener certeza sobre un símbolo poco común. Una práctica habitual es usar entidades con nombre para el puñado de las familiares (&copy;, &amp;, &nbsp;, &mdash;) y referencias numéricas para cualquier cosa exótica.

Emojis y caracteres más allá del rango básico

Los emojis y muchos símbolos viven en lo alto del rango Unicode, por encima de los valores que una sola unidad de código al estilo antiguo puede contener, pero las referencias numéricas los gestionan con limpieza porque simplemente nombran el punto de código. El emoji de cara sonriente tiene el punto de código U+1F600, así que puede escribirse como la referencia decimal &#128512; o la referencia hexadecimal &#x1F600;, y ambas producen el mismo glifo.

En la práctica, guardar tu archivo como UTF-8 y pegar el emoji directamente suele ser más sencillo e igual de correcto. Las referencias numéricas se vuelven valiosas cuando no se puede confiar en que una cadena de procesamiento preserve los bytes en bruto: una plantilla de correo, un sistema que aplana a ASCII o un contexto donde quieres que el punto de código exacto quede registrado de forma inequívoca. En cualquier caso, el carácter que aparece queda determinado por completo por su punto de código.

Decodificar texto con entidades distorsionado

Una tarea muy común en el mundo real es limpiar texto que llega lleno de códigos de entidad visibles. Copias un párrafo de una página web o de una exportación de base de datos y, en lugar de puntuación normal, ves &amp;, &#39;, &quot; y &#8217; esparcidos por él. Eso significa que el texto fue codificado en HTML en algún punto anterior y nunca se decodificó para mostrarlo. Pegarlo en el modo Decodificar de aquí convierte esas referencias de nuevo en los caracteres reales &, ', " y el apóstrofo curvo.

Vigila la doble codificación, la situación en la que el texto se escapó dos veces y ves secuencias como &amp;amp; o &amp;#39;. Aquí los caracteres literales &amp;amp; deberían convertirse en &amp; y luego en &, así que la solución es decodificar más de una vez hasta que no queden entidades. Si una sola pasada de decodificación todavía deja &amp; en tu salida, pasa el resultado por Decodificar de nuevo para eliminar la segunda capa.

Errores comunes

El error más frecuente es el punto y coma que falta. Una entidad solo es válida cuando está terminada, así que &copy sin punto y coma puede que no se represente como el signo de copyright. Un error relacionado es codificar el ampersand el último en lugar del primero al escapar a mano, lo que convierte tus otras entidades en texto literal como &amp;lt;.

Recuerda también que las entidades son un concepto de HTML, no una barrera de seguridad por sí solas. Codificar entradas no confiables en entidades es parte de evitar el marcado roto y el XSS, pero debe hacerse en el contexto correcto y en el momento de la salida, no confiarse como remedio universal. Por último, no codifiques caracteres que no lo necesitan dentro del contenido normal: la sobrecodificación hace que el código fuente sea más difícil de leer y no ofrece ningún beneficio cuando el archivo ya es UTF-8.

Preguntas frecuentes

¿Qué son las entidades HTML y por qué usarlas?
Las entidades HTML son códigos que representan caracteres reservados en HTML, como &lt; para < y &gt; para >. Usarlas te permite mostrar estos caracteres como texto en lugar de que el navegador los interprete como marcado.
¿Qué caracteres convierte el codificador?
Convierte los caracteres reservados y especiales de HTML, como el signo menor que (<), el signo mayor que (>) y el ampersand (&), en sus equivalentes de entidad con nombre para que se muestren de forma segura en una página.
¿Puedo convertir las entidades de nuevo en caracteres normales?
Sí. Cambia al modo Decodificar y pega texto que contenga entidades como &amp; o &lt;, y la herramienta devuelve los caracteres legibles originales.
¿Es útil para evitar HTML roto o XSS?
Codificar el texto proporcionado por el usuario en entidades ayuda a impedir que los caracteres especiales rompan la estructura de tu HTML y es un paso habitual al mostrar de forma segura contenido no confiable en una página.
¿Se envía mi texto a un servidor?
No. La codificación y la decodificación ocurren íntegramente en tu navegador, por lo que tu texto permanece en tu dispositivo, y la herramienta es de uso gratuito sin necesidad de registrarse.

Herramientas relacionadas

Sigue trabajando con estas prácticas herramientas

Generador de Meta Tags

Generador de Robots.txt

Open Graph Previewer

Visor de Cabeceras HTTP

Verificador de Cadenas de Redirección URL

Extractor de URLs de Sitemap