HTML-Entities-Decoder
é und é zurück in lesbaren Text verwandeln: benannte und numerische Referenzen, dezimal oder hexadezimal, im Browser.
Läuft vollständig in Ihrem Browser. Nichts wird hochgeladen, protokolliert oder gespeichert.
Text, der einmal zu oft durch eine Maskierung gelaufen ist, kommt voller é und é und & an. Dies liest ihn zurück: Jede Entität wird zu dem Zeichen, für das sie steht, und alles andere bleibt unangetastet.
Wie es funktioniert
Benannte Referenzen werden in der Tabelle von HTML 4.01 nachgeschlagen — 252 Namen, von & bis €. Numerische Referenzen werden als Codepunkt gelesen, dezimal (é) oder hexadezimal (é), in beiden Schreibweisen.
Alles, was keine Referenz ist, wird unangetastet herauskopiert, ein bloßes kaufmännisches Und eingeschlossen. Aus einer Seite herausgeholter Text ist sehr oft halb maskiert, und die ganze Eingabe wegen eines versprengten „&“ abzulehnen würde niemandem helfen.
Beispiele
| Fall | Eingabe | Ergebnis |
|---|---|---|
| Eine benannte Referenz | café | café |
| Dasselbe Zeichen über den Codepunkt | café and café | café and café |
| Zweimal maskierter Text, einmal dekodiert | Tom & Jerry | Tom & Jerry |
Häufige Fragen
In meinem Text steht danach immer noch &. Warum?
Weil er zweimal maskiert wurde. & dekodiert zu &, und das ist richtig: Ein Dekodiervorgang macht eine Maskierung rückgängig. Lassen Sie es noch einmal laufen, um die zweite rückgängig zu machen. Dass das Ergebnis noch maskiert ist, ist meist der interessante Befund — irgendetwas in der Kette maskiert eine Ausgabe, die schon maskiert war.
Ist es sicher, nicht vertrauenswürdigen Text zu dekodieren?
Das Dekodieren hier ist sicher — nichts wird als Markup dargestellt, und das Ergebnis erscheint in einem schlichten Textfeld. Nicht sicher ist es, das dekodierte Ergebnis wieder in eine Seite zu setzen: <script> dekodiert zu einem echten Tag, und genau deshalb war es maskiert.
Warum ist im Ergebnis kein normales Leerzeichen?
Weil es keines ist. Es dekodiert zu U+00A0, dem geschützten Leerzeichen, das gleich aussieht und sich anders verhält — es bricht nicht um, und der meiste Such- und Vergleichscode behandelt es als anderes Zeichen. Dieser Unterschied ist häufig genau der Fehler, der gesucht wird.
Werden die Entitätsnamen von HTML5 unterstützt?
Nur die 252 Namen von HTML 4.01. HTML5 fügt rund zweitausend weitere hinzu, überwiegend mathematische; die bleiben, wie sie geschrieben stehen, statt erraten zu werden. Numerische Referenzen funktionieren ungeachtet dessen für jedes Zeichen.
Gut zu wissen
- Alles geschieht in Ihrem Browser. Was Sie einfügen, wird nicht hochgeladen, nicht protokolliert und nicht gespeichert.