Text-zu-ASCII/Unicode-Code-Konverter

Wandeln Sie Text in eine Liste dezimaler Zeichencodes um und zurück — deckt den gesamten Unicode-Bereich ab, nicht nur 7-Bit-ASCII.

1.079 Aufrufe

Wie es funktioniert

Jedes Zeichen, das Sie eintippen, wird einzeln durchlaufen und in seinen Unicode-Codepunkt umgewandelt — dasselbe Nummerierungssystem, dessen erste 128 Werte, 0 bis 127, die ursprüngliche ASCII-Tabelle bilden. Innerhalb dieses Bereichs bilden die Codes 32-126 den druckbaren Block: Buchstaben, Ziffern, Satzzeichen und das Leerzeichen. Die Codes 0-31 sind Steuerzeichen, eine historische Schicht, die von Fernschreibern und Schreibmaschinen übrig geblieben ist, die bestimmte Codes verwendeten, um den Druckkopf oder das Papier zu bewegen, statt ein Zeichen zu drucken — Code 13 (Wagenrücklauf) schickte den Kopf zurück an den Zeilenanfang, und Code 10 (Zeilenvorschub) transportierte das Papier um eine Zeile weiter, eine Aufteilung, weshalb Textdateien auf unterschiedlichen Betriebssystemen sich bis heute nicht einig sind, wie ein Zeilenende gespeichert wird.

Beispiel: Das Eintippen von "Hi!" ergibt die Codeliste 72, 105, 33 — das große H ist 72, das kleine i ist 105, und das Ausrufezeichen ist 33, alle innerhalb des druckbaren Bereichs 32-126. Fügt man diese Liste zurück in den Decoder ein, wird "Hi!" exakt Zeichen für Zeichen wiederhergestellt.

Dort, wo dieses Tool über eine Lehrbuch-ASCII-Tabelle hinausgeht, sind die Codes 128 und darüber. Dieser obere Bereich, umgangssprachlich "erweitertes ASCII" genannt, wurde nie standardisiert: Verschiedene Hersteller und Regionen bauten unterschiedliche 256-Werte-Codepages und ordneten demselben Byte unterschiedliche Zeichen zu. Ein Byte, das auf einer türkischen Codepage "ğ" bedeutete, konnte auf der Codepage eines anderen Systems ein völlig anderes Zeichen bedeuten — oder gar nichts Druckbares. Genau dieses Problem sollten UTF-8 und vollständige Unicode-Codepunkte lösen: Statt eines Bytes pro Zeichen mit codepage-abhängiger Bedeutung erhält jedes Zeichen eine stabile numerische Identität, die überall dasselbe bedeutet. Deshalb kodiert dieser Konverter jedes Zeichen als vollständigen Unicode-Codepunkt, statt auf ein einzelnes Byte zu kürzen, sodass deutsche Umlaute wie ä, ö, ü, ß und Emoji zuverlässig umgewandelt werden.

Was Sie wissen sollten

  • Druckbarer Bereich: Codes 32-126 entsprechen auf jedem System immer einem sichtbaren Zeichen; alles andere braucht Kontext (eine Schriftart, eine Codepage oder vollständiges Unicode), um korrekt interpretiert zu werden.
  • Steuercodes haben kein Zeichen: Das Zurückdekodieren eines Werts von 0-31 (oder 127, DEL) in Text zeigt kein druckbares Zeichen — das ist erwartet, kein Fehler, da diese Codes nie zur Anzeige gedacht waren.
  • Jenseits von Byte 255: Unicode-Codepunkte reichen weit über die alte 256-Werte-Grenze hinaus — Emoji etwa liegen im Bereich von Hunderttausenden — und dieses Tool verarbeitet den vollen Bereich, nicht nur den Umfang eines einzelnen Bytes.
  • Verlustfreier Hin- und Rückweg: Kodieren und anschließendes Dekodieren liefert immer exakt Ihren ursprünglichen Text zurück, da jeder Codepunkt auf genau ein Zeichen abgebildet wird, ohne dass etwas angenähert oder komprimiert wird.
  • Läuft vollständig in Ihrem Browser: Es wird kein Text irgendwohin gesendet, daher ist es sicher, auch sensible Zeichenketten, Tokens oder Passwörter zum Debuggen zu konvertieren.

Häufig gestellte Fragen

Ist das wirklich ASCII, oder mehr?

Echtes 7-Bit-ASCII deckt nur die Codes 0-127 ab (englische Buchstaben, Ziffern, einfache Satzzeichen). Dieses Tool nutzt dieselbe Idee, erweitert sie aber auf den vollen Bereich der Unicode-Codepunkte, sodass deutsche Umlaute (ä, ö, ü, ß), akzentuierte Buchstaben und Emoji korrekt umgewandelt werden, statt fehlerhaft zu sein oder auf ein Fragezeichen zurückzufallen.

Welches Trennzeichen verwendet die Codeliste?

Standardmäßig Kommas mit einem Leerzeichen danach — der Decoder akzeptiert aber auch Codes, die nur durch Leerzeichen oder Zeilenumbrüche getrennt sind, sodass eine aus einem anderen Tool kopierte Liste meist ohne Neuformatierung funktioniert.

Was ist der Unterschied zwischen Code 10 und Code 13?

Beide sind historische Steuerzeichen für Zeilenenden: Code 10 ist "Zeilenvorschub" (eine Zeile nach unten), und Code 13 ist "Wagenrücklauf" (zurück an den Zeilenanfang). Unix verwendet allein LF, der klassische Mac verwendete allein CR, und Windows verwendet beide zusammen (CRLF) — eine Aufteilung, die direkt auf physische Fernschreiber-Hardware zurückgeht.

Warum sehen Codes über 127 in anderen Tools anders aus?

Weil dieser Bereich nie standardisiert wurde. Die "erweiterte ASCII"-Codepage jedes Herstellers ordnete den Bytes 128-255 ihre eigenen Zeichen zu, sodass derselbe Bytewert auf unterschiedlichen Systemen zu unterschiedlichen Zeichen dekodiert werden kann. Dieses Tool umgeht das vollständig, indem es mit vollständigem Unicode statt mit einer festen 256-Werte-Tabelle arbeitet.

Kann dieses Tool Emoji und andere Mehrbyte-Zeichen verarbeiten?

Ja — Emoji und viele andere Symbole liegen bei Codepunkten weit jenseits von 255, und dieses Tool wandelt jedes einzelne in seinen vollständigen dezimalen Unicode-Wert um (manche Emoji, etwa Flaggen, bestehen tatsächlich aus zwei Codepunkten, die die Liste als zwei separate Zahlen anzeigt).

Kommentare

Noch keine Kommentare — schreiben Sie den ersten!

Ähnliche Tools