T

Text Machine

Alat teks andal, di browser Anda

HTML Entity Encoder/Decoder

This tool allows you to convert text with special characters to HTML entities and vice versa. HTML entities help display special characters correctly on web pages.

Mode

Text to Encode
Characters like <, >, &, " and ' will be converted to HTML entities
Encoded HTML
Common HTML Entities

<

&lt;

Less than sign

>

&gt;

Greater than sign

&

&amp;

Ampersand

"

&quot;

Double quotation mark

'

&#39;

Single quotation mark

©

&copy;

Copyright symbol

®

&reg;

Registered trademark

Cara menggunakan Pengenkode/Pendekode Entitas HTML

  1. 1

    Masukkan teks Anda

    Tempel teks atau cuplikan HTML yang ingin Anda konversi ke dalam kotak input.

  2. 2

    Pilih encode atau decode

    Klik Encode untuk mengubah karakter khusus menjadi entitas HTML, atau Decode untuk mengubah entitas kembali menjadi karakter.

  3. 3

    Dapatkan hasilnya

    Output yang dikonversi muncul seketika di panel hasil.

  4. 4

    Salin output

    Gunakan Copy Result untuk mengambil teks yang telah di-encode atau di-decode untuk proyek Anda.

Panduan Praktis untuk Entitas HTML

Apa itu entitas HTML

Entitas HTML, yang lebih resmi disebut referensi karakter, adalah kode pendek yang menggantikan satu karakter dalam HTML. Setiap entitas diawali dengan ampersand (&) dan diakhiri dengan titik koma (;). Entitas memungkinkan Anda menyertakan karakter yang jika tidak akan disalahartikan browser sebagai markup, karakter yang sulit diketik, atau karakter yang tidak ada di papan ketik Anda, sekaligus menjaga berkas sumber tetap dalam ASCII biasa.

Entitas penting karena dua alasan berbeda. Pertama, beberapa karakter dicadangkan oleh HTML sendiri dan harus di-escape agar tampil dengan benar. Kedua, dunia simbol yang luas, huruf beraksen, tanda mata uang, panah, dan emoji dapat ditulis secara andal sebagai referensi terlepas dari pengkodean teks berkasnya. Alat ini mengkodekan karakter menjadi entitas dan mendekode entitas kembali menjadi karakter yang diwakilinya.

Referensi bernama versus numerik

Ada dua cara menulis sebuah entitas, dan keduanya saling dipertukarkan dalam hal yang dihasilkan. Referensi bernama menggunakan label yang dapat dibaca manusia, seperti &copy; untuk tanda hak cipta, &amp; untuk ampersand, atau &nbsp; untuk spasi tak-putus. HTML mendefinisikan daftar nama yang tetap ini, jadi hanya karakter dengan nama yang ditetapkan yang dapat ditulis dengan cara ini.

Referensi numerik menggunakan titik kode Unicode karakter alih-alih sebuah nama, dan dapat mewakili karakter apa pun tanpa terkecuali. Bentuk desimalnya adalah sebuah ampersand, sebuah tagar, titik kode dalam basis 10, dan sebuah titik koma — misalnya &#169;. Bentuk heksadesimalnya menambahkan x setelah tagar dan memberikan titik kode dalam basis 16 — misalnya &#xA9;. Ketiganya, &copy;, &#169;, dan &#xA9;, merender simbol © yang identik, karena 169 dalam desimal sama dengan A9 dalam heksadesimal sama dengan titik kode hak cipta.

Lima karakter yang selalu perlu di-escape

Sebagian besar karakter opsional untuk dikodekan, tetapi sekelompok kecil pada praktiknya wajib dalam sumber HTML. Ampersand & (&amp;) harus di-escape karena ia mengawali setiap entitas; biarkan mentah di samping sebuah kata dan browser mungkin mencoba mengurai entitas yang sebenarnya tidak ada. Tanda kurang dari < (&lt;) dan tanda lebih besar > (&gt;) harus di-escape dalam teks karena keduanya membatasi tag. Di dalam nilai atribut, tanda kutip ganda " (&quot;) dan apostrof ' (&#39;) perlu di-escape agar tidak menutup atribut terlalu dini.

Selebihnya hanyalah demi kepraktisan. Anda dapat menulis é langsung dalam berkas UTF-8 atau sebagai &eacute; atau &#233; — semuanya valid. Lima karakter cadangan itu berbeda: salah menanganinya menghasilkan markup yang rusak atau, dengan masukan tak tepercaya, sebuah celah cross-site scripting, jadi keduanya adalah karakter yang tidak boleh Anda biarkan tanpa di-escape di tempat yang salah.

Contoh nyata: simbol dan aksen

Misalkan Anda ingin sebuah footer bertuliskan "© 2026 Café Ünïcode — 100% safe". Beberapa karakter ini bukan ASCII biasa. Tanda hak cipta dapat ditulis sebagai &copy; atau &#169;. Huruf é di Café adalah &eacute; atau &#233;, dan Ü adalah &Uuml; atau &#220;. Tanda hubung em — adalah &mdash; atau &#8212;, dan spasi tak-putus yang menjaga "100%" tetap bersama adalah &nbsp;.

Mengkodekan seluruh string menghasilkan sesuatu seperti &copy; 2026 Caf&eacute; &Uuml;n&iuml;code &mdash; 100% safe, yang dijamin tampil identik tidak peduli bagaimana pengkodean karakter halaman dikonfigurasi. Mendekodekannya di sini membalik prosesnya dan mengembalikan baris yang terbaca dengan simbol aslinya di tempatnya.

Memilih bernama atau numerik

Entitas bernama unggul dalam keterbacaan. &copy; dan &mdash; memberi tahu pembaca di masa depan dengan persis apa karakternya, yang membuat sumber lebih mudah dipelihara daripada deretan kode numerik. Pertukarannya adalah cakupan: hanya karakter dengan nama yang ditetapkan yang dapat ditulis dengan nama, dan daftarnya, meski besar, tidak mencakup segalanya.

Referensi numerik unggul dalam universalitas dan ketelitian. Karena keduanya menunjuk titik kode Unicode secara langsung, keduanya dapat mengkodekan karakter apa pun yang ada, termasuk yang tidak punya nama dan termasuk emoji. Keduanya juga tidak ambigu, yang berguna ketika Anda perlu memastikan sebuah simbol yang langka. Praktik umum adalah menggunakan entitas bernama untuk sekelompok karakter yang familier (&copy;, &amp;, &nbsp;, &mdash;) dan referensi numerik untuk apa pun yang eksotis.

Emoji dan karakter di luar rentang dasar

Emoji dan banyak simbol berada tinggi dalam rentang Unicode, di atas nilai yang dapat ditampung oleh satu unit kode gaya lama, tetapi referensi numerik menanganinya dengan rapi karena keduanya cukup menamai titik kodenya. Emoji wajah menyeringai memiliki titik kode U+1F600, jadi dapat ditulis sebagai referensi desimal &#128512; atau referensi heksadesimal &#x1F600;, keduanya menghasilkan glif yang sama.

Dalam praktiknya, menyimpan berkas Anda sebagai UTF-8 dan menempelkan emoji secara langsung biasanya lebih sederhana dan sama benarnya. Referensi numerik menjadi berharga ketika sebuah pipeline tidak dapat dipercaya untuk mempertahankan byte mentah — sebuah templat email, sistem yang meratakan ke ASCII, atau konteks di mana Anda ingin titik kode persis tercatat tanpa ambiguitas. Bagaimanapun, karakter yang muncul ditentukan sepenuhnya oleh titik kodenya.

Mendekode teks entitas yang berantakan

Tugas dunia nyata yang sangat umum adalah membersihkan teks yang tiba penuh dengan kode entitas yang kasatmata. Anda menyalin sebuah paragraf dari halaman web atau ekspor basis data dan alih-alih tanda baca normal Anda melihat &amp;, &#39;, &quot;, dan &#8217; bertebaran di dalamnya. Itu berarti teks tersebut di-encode HTML di suatu tempat di hulu dan tidak pernah didekode untuk ditampilkan. Menempelkannya ke mode Decode di sini mengubah referensi-referensi itu kembali menjadi karakter &, ', ", dan apostrof melengkung yang asli.

Waspadai pengkodean ganda, situasi di mana teks di-escape dua kali sehingga Anda melihat urutan seperti &amp;amp; atau &amp;#39;. Di sini karakter harfiah &amp;amp; semestinya menjadi &amp; lalu &, jadi perbaikannya adalah mendekode lebih dari sekali sampai tidak ada entitas yang tersisa. Jika satu lintasan dekode masih menyisakan &amp; di keluaran Anda, jalankan hasilnya melalui Decode lagi untuk membuang lapisan kedua.

Jebakan umum

Kesalahan paling sering adalah titik koma yang hilang. Sebuah entitas hanya valid ketika diakhiri, jadi &copy tanpa titik koma mungkin tidak dirender sebagai tanda hak cipta. Kesalahan terkait adalah mengkodekan ampersand terakhir alih-alih pertama saat meng-escape secara manual, yang mengubah entitas-entitas lain Anda menjadi teks harfiah seperti &amp;lt;.

Ingat juga bahwa entitas adalah konsep HTML, bukan batas keamanan dengan sendirinya. Mengkodekan masukan tak tepercaya menjadi entitas adalah bagian dari mencegah markup rusak dan XSS, tetapi harus dilakukan dalam konteks yang tepat dan pada saat keluaran, bukan diandalkan sebagai obat segala penyakit. Terakhir, jangan mengkodekan karakter yang tidak memerlukannya di dalam konten biasa — pengkodean berlebihan membuat sumber lebih sulit dibaca dan tidak memberi manfaat apa pun saat berkasnya sudah UTF-8.

Pertanyaan yang sering diajukan

Apa itu entitas HTML dan mengapa menggunakannya?
Entitas HTML adalah kode yang mewakili karakter cadangan dalam HTML, seperti &lt; untuk < dan &gt; untuk >. Menggunakannya memungkinkan Anda menampilkan karakter ini sebagai teks alih-alih membuat browser menafsirkannya sebagai markup.
Karakter apa yang dikonversi oleh encoder?
Alat ini mengonversi karakter cadangan dan khusus HTML seperti tanda lebih kecil (<), tanda lebih besar (>), dan ampersand (&) menjadi padanan entitas bernamanya sehingga dapat dirender dengan aman di halaman.
Bisakah saya mengonversi entitas kembali menjadi karakter normal?
Ya. Beralih ke mode Decode dan tempel teks yang berisi entitas seperti &amp; atau &lt;, maka alat ini akan mengembalikan karakter asli yang terbaca.
Apakah ini berguna untuk mencegah HTML rusak atau XSS?
Meng-encode teks yang disediakan pengguna menjadi entitas membantu mencegah karakter khusus merusak struktur HTML Anda dan merupakan langkah umum saat menampilkan konten tidak tepercaya dengan aman di halaman.
Apakah teks saya dikirim ke server?
Tidak. Encoding dan decoding terjadi sepenuhnya di browser Anda, sehingga teks Anda tetap di perangkat Anda, dan alat ini gratis digunakan tanpa perlu mendaftar.

Alat terkait

Lanjutkan dengan alat praktis ini

Generator Meta Tag

Generator Robots.txt

Open Graph Previewer

Penampil Header HTTP

Pemeriksa Rantai Pengalihan URL

Ekstraktor URL Sitemap