HTML-entiteiten decoderen
Zet é en é terug om in leesbare tekst: benoemde en numerieke verwijzingen, decimaal of hexadecimaal, in je browser.
Draait volledig in je browser. Er wordt niets geüpload, gelogd of opgeslagen.
Tekst die één keer te vaak door een escapestap is gegaan, komt binnen vol é, é en &. Dit leest hem terug: elke entiteit wordt het teken dat ze voorstelt, en al het andere blijft zoals het is.
Hoe het werkt
Benoemde verwijzingen worden opgezocht in de tabel van HTML 4.01: 252 namen, van & tot €. Numerieke verwijzingen worden gelezen als een codepunt, decimaal (é) of hexadecimaal (é), in beide gevallen.
Alles wat geen verwijzing is, wordt ongewijzigd overgenomen, ook een losse ampersand. Tekst die van een pagina is gehaald, is heel vaak half ge-escapet, en de hele invoer weigeren om één verdwaalde “&” zou niemand helpen.
Voorbeelden
| Geval | Invoer | Resultaat |
|---|---|---|
| Een benoemde verwijzing | café | café |
| Hetzelfde teken via codepunt | café and café | café and café |
| Twee keer geëscapete tekst, één keer gedecodeerd | Tom & Jerry | Tom & Jerry |
Veelgestelde vragen
Mijn tekst bevat daarna nog &. Waarom?
Omdat hij twee keer ge-escapet is. & wordt gedecodeerd als &, en dat klopt: één keer decoderen maakt één keer escapen ongedaan. Haal hem er nog een keer doorheen om de tweede ongedaan te maken. Dat het resultaat nog ge-escapet is, is meestal de interessante vondst: iets in de keten escapet uitvoer die al ge-escapet was.
Is het veilig om tekst te decoderen die je niet vertrouwt?
Hier decoderen is veilig: er wordt niets als opmaak weergegeven en het resultaat staat in een vak met platte tekst. Wat niet veilig is, is het gedecodeerde resultaat weer in een pagina zetten: <script> wordt gedecodeerd tot een echte tag, en dat is precies de reden waarom het ge-escapet was.
Waarom is in het resultaat geen gewone spatie?
Omdat het dat niet is. Het wordt gedecodeerd als U+00A0, de harde spatie, die er hetzelfde uitziet en zich anders gedraagt: er mag geen regel op worden afgebroken, en bijna alle zoek- en vergelijkingscode behandelt het als een ander teken. Dat verschil is vaak de bug waar je naar zoekt.
Worden de entiteitnamen van HTML5 ondersteund?
Alleen de 252 namen uit HTML 4.01. HTML5 voegt er zo'n tweeduizend aan toe, vooral wiskundige; die blijven staan zoals ze zijn in plaats van geraden te worden. Numerieke verwijzingen werken hoe dan ook voor elk teken.
Goed om te weten
- Alles gebeurt in je browser. Wat je plakt, wordt niet geüpload, niet gelogd en niet opgeslagen.