Command Palette

Search for a command to run...

ASCII-Tabelle: Der vollständige Leitfaden zu den Zeichencodes (0 – 255)

ASCII-Tabelle: Der vollständige Leitfaden zu den Zeichencodes (0 – 255)

T
Toolz Team
|Aug 23, 2026|15 min lesen

Teil der Sammlung binär & hex

Als mir ASCII zum ersten Mal wirklich wichtig war, debuggte ich einen CSV-Import für ein WordPress-Plugin, das immer wieder eine Adresse von customer' in zwei Zeilen aufteilteDie Datei sah in jedem Editor, in dem ich sie öffnete, in Ordnung aus Es stellte sich heraus, dass ein Export eine blanke Wagenrückgabe (Code 13) als Zeilenende verwendet hatte, während mein Parser einen Zeilenvorschub (Code 10) erwartete, und ein streunender Datensatztrenner (Code 30) hatte sich aus einem vorgelagerten Mainframe-Export eingeschlichen Keines dieser Zeichen kann man sie nicht sehen Man kann sie nur sehen, wenn man eine Tabelle hat, die das unsichtbare Byte in eine Zahl und einen Namen verwandelt - genau deshalb habe ich das ASCII-Tisch auf Toolz.dev und warum ich es in einem Browser-Tab feststeckend halte.

tl; dr: ASCII ordnet jedes grundlegende englische Zeichen und einen Satz Steuersignale den Nummern 0 acline127 zu; Erweiterte Sätze wie ISO 8859-1 (Latein-1) füllen 1286255 aus. Großbuchstaben A 65 ist, Kleinbuchstaben a 97 ist, der Speicherplatz 32 ist und das & quot; unsichtbar" Codes 0 31 sind Steuerzeichen wie Tabulator (9), Zeilenvorschub (10) und Wagenrücklauf (13).Wenn Sie die Tabelle lesen können, können Sie fast jeden Textkodierungsfehler dekodieren, jedes Zeichen sicher in HTML entfernen und verstehen, warum sich UTF-8, JSON und jede Programmiersprache so verhalten wie mit Zeichenfolgen.

I & #39; habe Jahre damit verbracht, Dinge zu entwickeln, die bei der Textverarbeitung leben und sterben - ein WordPress-Admin-Plugin, Laravel-APIs, React-Frontends - und ich kann Ihnen sagen, dass ein funktionierendes mentales ASCII-Modell mehr Debugging-Stunden spart als fast jedes andere Stück Wissen auf niedrigem Niveau. Dieser Leitfaden ist die Version, von der ich mir wünschte, jemand hätte sie mir vorzeitig übergeben.

Was ist ASCII und warum ist es immer noch wichtig?

ASCII steht für den American Standard Code for Information Interchange. Es wurde erstmals 1963 standardisiert und in der Form abgelegt, die wir noch heute als ANSI X3.4-1986 verwenden (international auch als ISO/IEC 646 veröffentlicht), und die Netzwerkdefinition wird auch heute noch zitiert RFC 20 (1969).Im Kern ist es eine Nachschlagetabelle: eine Abbildung von den Zahlen 0 bis 127 auf einen bestimmten Satz Zeichen und Steuersignale Sieben Bit, 128 Slots, eine Übereinstimmung, die die ganze Rechenwelt teilen könnte.

Diese Vereinbarung ist der Grund dafür, dass eine Textdatei, die 1990 auf einem Linux-Server geschrieben wurde, auch heute noch korrekt auf einem Mac-Laptop geöffnet wird. Vor Standard-Zeichencodes hatte jeder Hersteller sein eigenes Schema, und das Verschieben von Text zwischen Maschinen war ein Übersetzungsproblem. ASCII hat die unteren 128 Codes behoben und seitdem hat es sich nie bewegt.

Was die Leute überrascht, ist, wie viel von modernem Computing noch immer direkt darauf ruht Unicode - der riesige Standard, der Emoji, Chinesisch, Arabisch und jedes andere Skript abdeckt - macht seine ersten 128 Codepunkte bewusst identisch mit ASCII. UTF-8, die Kodierung, die das Web antreibt, kodiert diese ersten 128 Codepunkte als einzelne Bytes mit den genauen ASCII-Werten. Also ist eine einfache ASCII-Textdatei auch Eine gültige UTF-8-Datei, Byte für Byte Wenn Sie ASCII verstehen, haben Sie die Grundlage verstanden, auf der der Rest der Textkodierung aufbaut.

Wie ist die ASCII-Tabelle organisiert?

Die 128 Standardcodes lassen sich in einige natürliche Gruppen einteilen, und die Kenntnis der Gruppe ist oft nützlicher, als sich einen einzelnen Wert zu merken.

Kontrollzeichen (031 und 127). Dies sind die nicht druckenden Codes. Sie tragen Anweisungen statt Glyphen: Null (0), Glocke (7), Rücktaste (8), horizontale Registerkarte (9), Zeilenvorschub (10), Wagenrücklauf (13), Escape (27) und Löschen (127) sind diejenigen, die Sie und #39; tatsächlich treffen. Sie wurden entwickelt, um Fernschreibmaschinen anzutreiben, und ihre Geister führen immer noch alles aus, von Zeilenenden in Ihren Quelldateien bis hin zu den Escape-Sequenzen, die Ihre Terminalausgabe einfärben.

Druckbare Zeichensetzung und Symbole (32 47, 58 64, 91 – 96, 123 – 126). Der Leerzeichen beträgt 32 - der niedrigste druckbare Code und technisch gesehen ein Druckzeichen, obwohl es nichts anzeigt. Der Rest sind die Symbole, die auf Ihrer Tastatur verstreut sind: ! 33 ist, ist @ 64 ist, ist ~ 126 ist.

Ziffern (48 – 57). Die Charaktere 0 durchgehend 9 Setzen Sie sich in einen ordentlichen Lauf von 48 bis 57. Diese Reihenfolge ist bewusst: Subtrahieren Sie 48 von einem Ziffer' s-Code und Sie erhalten seinen numerischen Wert, der so ist, wie fast jedes & quot; eine Zahl aus einem Zeichenfolgen&Quoten; Routine beginnt.

Großbuchstaben (65 –90) und Kleinbuchstaben (97 – 122). A 65 ist, ist Z 90 ist; a 97 ist, ist z Ist 122. Die Lücke zwischen einem Buchstaben' s Groß - und Kleinschreibung ist immer genau 32.

Der erweiterte Bereich (128 – 255) ist ein anderes Tier, und it& #39;s, in denen die meiste Verwirrung herrscht - daher erhält es unten einen eigenen Abschnitt.

Was ist der Unterschied zwischen ASCII und Extended ASCII?

Standard-ASCII definiert nur 128 Codes, da es nur sieben Bit verwendet Aber Computer speichern Text in Acht-Bit-Bytes, wodurch ganze zusätzliche 128 Slots (128 – 255) vom Standard ungenutzt bleiben. " Erweitertes ASCII" ist der Überbegriff für die verschiedenen Schemata, die diese Slots füllen.

Der Haken - und it' s ein großer - ist, dass es kein einziges erweitertes ASCII gibt Verschiedene Codepages ordnen die oberen 128 Codes völlig anders zu IBM' s Codepage 437 setzen dort Box-Drawing-Zeichen ein Windows-1252 setzen dort lockige Zitate und das Euro-Zeichen ISO/IEC 8859-1, bekannt als Latin-1, setzte dort akzentuierte westeuropäische Buchstaben ein Byte mit dem Wert 233 ist é In Latein-1, aber etwas anderes ganz im Codepage 437.

Auf Toolz.dev zeige ich die ISO 8859-1 (Latein-1) Zuordnung für die Codes 160 – 255, weil es ein echter veröffentlichter Standard ist und es die Grundlage des ursprünglichen HTML-Zeichensatzes ist - was bedeutet, dass die benannten HTML-Entitäten sich aufstellen Die Codes 128159 in Latein-1 sind ein zweiter Block von Steuerzeichen (die "C1" Steuerelemente), so dass das Tool sie als solche beschriftet, anstatt sie vorzutäuschen' druckbar.

Die praktische Lektion: wenn jemand sagt " erweitertes ASCII, " immer fragen Welches. Eine nicht übereinstimmende Codepage ist die klassische Ursache für die é Mojibake sehen Sie, wenn eine UTF-8-Datei als Latin-1 gelesen wird, oder die fehlenden Glyphenfelder, wenn das Gegenteil passiert. Verstehen Datenschutz und Umgang von Tools mit Ihrem Text ist ein Anliegen; Wenn man versteht, wie Bytes Zeichen zugeordnet werden, ist die andere Hälfte davon, nie wieder von verstümmeltem Text überrascht zu werden.

Warum unterscheiden sich Groß - und Kleinschreibung genau um 32?

Dies ist mein Lieblingsstück des ASCII-Designs, denn es' ist kein Unfall - es' s-Engineering Das Layout wurde so gewählt, dass sich die Groß- und Kleinbuchstabenform von Letter's nur in Bit 5 unterscheidet, das den Wert 32 hat. A 65 ist (binär 01000001); a 97 ist (binär 01100001). Der einzige Unterschied besteht darin, dass ein einzelnes Bit.

Diese Entscheidung bedeutet, dass ein Programm den Fall mit einer bitweisen Operation anstelle einer Nachschlagetabelle ändern kann. Um einen Kleinbuchstaben zu vergrößern, löschen Sie Bit 5 (code & ~32); um eine Großbuchstabe zu senken, stellen Sie sie ein (code | 32); Um den Fall so oder so auszutauschen, drehen Sie ihn um (code ^ 32). Jahrzehnte von String-Bibliotheken wurden auf diesem Trick aufgebaut, bevor Unicode's komplexere Fallregeln es für alles jenseits von einfachem ASCII unsicher machten Wenn Sie die Tabelle durchsuchen und feststellen, dass jeder Großbuchstabe genau 32 unter seinem Kleinbuchstaben Twin sitzt, schauen Sie' auf eine Entscheidung, die in den 1960 er Jahren getroffen wurde und immer noch die Art und Weise prägt, wie Software geschrieben wird.

Wie konvertiere ich zwischen Zeichen, Dezimalzeichen, Hexzeichen und Binärzeichen?

Jeder ASCII-Code hat vier gemeinsame Darstellungen, und der Wechsel zwischen ihnen ist ein routinemäßiger Teil der Arbeit auf niedriger Ebene. Hier und #39; erfahren Sie, wie sie für den Buchstaben zusammenhängen H:

Darstellung Wert für H Wo Sie und #39; werde es sehen
Charakter H Normaler Text
dezimal 72 String.fromCharCode(72), chr(72)
hexadezimal 48 Hex-deponien \x48URL/prozentuale Kodierung
Oktal 110 Ältere Unix-Tools \110 Flucht
binär 01001000 Bitweise Operationen, Protokolldesign

Um ein Wort aus Hex zu buchstabieren, nehmen Sie jedes Paar Hex-Ziffern als ein Byte: 48 69 72 105 in der Dezimalzahl ist, also Hi. Um in die andere Richtung zu gehen, schauen Sie nach jedem Zeichen' s-Code Die ASCII-Tisch Hat beide Richtungen - es zeigt alle fünf Spalten für jeden Code an und sein Suchfeld akzeptiert ein Zeichen, eine Dezimalzahl, einen Hex-Wert (mit oder ohne 0x Präfix), eine Oktal- oder Binärzeichenfolge oder sogar ein HTML-Entitätsname, also tippen &, 38, oder amp Alle springen zum Ampersand.

Wenn Sie & #39; re routinemäßig ganze Zeichenfolgen konvertieren oder über Zahlenbasen jenseits von ASCII arbeiten, ist die Binärübersetzer und das Zahlenbasiskonverter Sind die Begleitwerkzeuge, nach denen ich greife Die ASCII-Tabelle ist die Referenz; diese beiden sind die Werkbänke.

Wozu dienen ASCII-Steuerzeichen eigentlich?

Die nicht druckenden Codes 0 31 (plus 127) fühlen sich wie Museumsstücke an, aber einige davon bestimmen Ihr Leben täglich.

Leitungsvorschub (10) und Wagenrücklauf (13) Sind die großen zwei Bei einem Fernschreiber bewegte der Wagenrücklauf den Druckkopf wieder nach links und der Zeilenvorschub erweiterte das Papier um eine Zeile - zwei separate physische Aktionen. Deshalb beenden Windows-Textdateien Zeilen mit beiden (CRLF13, dann 10), während Unix und macOS nur Zeilenvorschub verwenden (LF, 10).Nahezu jedes " why ist meine Datei voll von ^M Zeichen?" Bug geht auf diese Spaltung zurück Meine CSV-Katastrophe aus dem Intro war genau diese.

Horizontale Lasche (9) ist das Tabulatorzeichen - ein einzelnes Byte, das Editoren als mehrere Leerzeichen rendern. Null (0) Beendet Zeichenfolgen in C und markiert & quot; no data" in unzähligen Formaten. Flucht (27) Stellt die Steuersequenzen vor, die Ihren Cursor bewegen und Ihr Terminal färben. Glocke (7) Einmal klingelte es tatsächlich; Jetzt piept oder blinkt es Ihr Terminalfenster.

Der Grund, warum eine gute Tabelle diese Codes nennt, ist wichtig: Wenn Sie ein Byte 27 in Ihren Daten finden, wird "ESC - Escape" sagt Ihnen sofort, dass Sie & #39; eine Terminalsteuersequenz betrachten, nicht einen beschädigten Text Eine Rohzahl würde Sie raten lassen.

Wie verhält sich ASCII zu HTML-Entitäten und sicherem Escapezeichen?

Wenn Sie für das Web schreiben - und bauen Ein solides Entwickler-Toolkit Bedeutet, dass Sie es tun werden - eine Handvoll ASCII-Zeichen müssen entkommen, damit der Browser sie nicht falsch als Markup liest. Das Less-Than-Zeichen < (60), größer als > (62), Ampersand & (38) und doppeltes Zitat " (34) sind die gefährlichen vier. Wenn sie roh in HTML bleiben, können sie Ihre Seite aufbrechen oder ein Injektionsloch öffnen; als Entitäten geschrieben (&lt;, &gt;, &amp;, &quot;) sie werden als wörtliche Zeichen wiedergegeben.

Jeder Code hat auch eine numerische HTML-Entität im Formular &#code;So kann auch ein Zeichen ohne benannte Entität immer sicher geschrieben werden Die ASCII-Tabelle listet die benannte Entität auf, wo eine existiert, und die numerische Form ansonsten, und wenn Sie auf die HTML-Spalte klicken, kopiert sie sie direkt in Ihre Zwischenablage Wenn Sie einen ganzen Markup-Block kodieren oder dekodieren müssen, anstatt ein einzelnes Zeichen nachzuschlagen, wird die HTML-Entitäten Tool übernimmt den Batch-Job Für einen tieferen Rundgang durch die Codierungsdienstprogramme, die ich täglich verwende, ist die Anleitung für die Coding-Tools Durch das ganze Set geht.

Ist die ASCII-Tabelle dasselbe wie Unicode?

Nein, aber sie&#39;re bewusst kompatibel, und die Beziehung lohnt sich, gerade zu bekommen Unicode ist ein weitaus größerer Standard - über eine Million mögliche Codepunkte, die jedes Schriftsystem plus Symbole und Emoji abdecken ASCII ist mit seinen 128 Codes eine winzige Teilmenge, was sie dazu bringt, schön zusammen zu spielen, ist, dass Unicode&#39;s erste 128 Codepunkte als identisch mit ASCII definiert sind, und UTF-8 kodiert genau diese 128 als Einzelbytes mit ihren ASCII-Werten.

Die Konsequenz ist elegant: Jede gültige ASCII-Datei ist automatisch eine gültige UTF-8-Datei. Man muss nie einfachen englischen Text zwischen den beiden konvertieren In dem Moment, in dem man über Code 127 hinausgeht - ein akzentuierter Buchstabe, ein geschweiftes Zitat, ein Emoji - lässt man ASCII hinter sich und man&#39; ist fest im Multi-Byte-Unicode-Territorium, wo ein Zeichen zwei, drei oder vier Bytes belegen darf Die Toolz.dev ASCII-Tabelle deckt direkt die Bereiche ASCII und Latin-1 ab, und ihr Text-Encoder meldet den Unicode-Codepunkt für jedes Zeichen, das Sie darüber hinaus einfügen, sodass Sie genau sehen können, wo ASCII endet und Unicode übernimmt.

Häufig gestellte Fragen

Was ist ASCII?

ASCII (American Standard Code for Information Interchange) ist ein Zeichenkodierungsstandard, der Buchstaben, Ziffern, Interpunktion und Steuersignale auf die Zahlen 0–127 zuordnet. Es wurde 1963 als ANSI X3.4 standardisiert und bleibt die Grundlage moderner Textcodierungen, einschließlich UTF-8, deren erste 128 Codepunkte mit ASCII identisch sind.

Was ist der ASCII-Wert von & quot;A&quot;?

Der Großbuchstabe &quot; A&quot; hat den ASCII-Wert 65 (hex 41, octal 101, binary 01000001). Kleinbuchstabe & quot;a&quot; ist 97 - genau 32 höher - weshalb das Umdrehen von Bit 5 einen Buchstaben zwischen Groß - und Kleinbuchstaben schaltet.

Was ist der Unterschied zwischen ASCII und Extended ASCII?

Standard ASCII verwendet 7 Bit und definiert 128 Codes (0127). &quot; Extended ASCII&quot; verwendet das achte Bit, um weitere 128 Codes (128 OUTLINE255) für akzentuierte Buchstaben, Symbole und Box-Drawing-Zeichen hinzuzufügenEs gibt kein einziges erweitertes ASCII - verschiedene Codepages weisen die obere Hälfte unterschiedlich zu Diese Tabelle zeigt die Zuordnung ISO 8859-1 (Latein-1), die Grundlage des lateinischen HTML-Zeichensatzes 1.

Was sind ASCII-Steuerzeichen?

Die Codes 0–31 und 127 sind nicht druckende Steuerzeichen, die Anweisungen enthalten und nicht sichtbare Glyphen. Zu den üblichen gehören Zeilenvorschub (10), Wagenrücklauf (13), horizontaler Laschen (9), Escape (27) und Null (0). Sie steuerten ursprünglich Teletyp-Maschinen und terminieren immer noch Linien, Felder und Treiberterminal-Escape-Sequenzen.

Wie konvertiere ich Hex in ASCII?

Jedes Hex-Ziffernpaar steht für ein Byte, das einem ASCII-Code zugeordnet wird Hex 48 ist 72 in der Dezimalzahl, das ist &quot; H&quot;; hex 69 ist 105, das ist &quot; i&quot; - also 48 69 Zauber & quot; Hi&quot;. Durchsuchen Sie die ASCII-Tabelle nach dem Hex-Wert (mit oder ohne 0-fach-Präfix), um das passende Zeichen sofort zu finden.

Warum unterscheidet sich Großbuchstaben in ASCII von Kleinbuchstaben um 32?

ASCII wurde so angelegt, dass der einzige Unterschied zwischen einer Buchstaben - & #39; s Groß - und Kleinbuchstabenform Bit 5 ist (der Wert 32). & quot; A&quot; ist 65 und & quot; a&quot; ist 97; & quot; Z&quot; ist 90 und &quot; z&quot; ist 122. Dieses bewusste Design ermöglicht es Programmen, den Fall mit einer einzigen bitweisen Operation statt mit einer Nachschlagetabelle zu ändern.

Ist die ASCII-Tabelle dasselbe wie Unicode?

Nicht gleich, aber kompatibel Unicode ist ein weitaus größerer Standard, der über jedes Schriftsystem hinweg mehr als eine Million Codepunkte abdeckt Seine ersten 128 Codepunkte sind identisch mit ASCII, und UTF-8 kodiert sie als einzelne Bytes, sodass gültiger ASCII-Text auch UTF-8. Die ASCII-Tabelle deckt die Bereiche ASCII und Latin-1 ab; ihr Kodierer meldet Unicode-Codepunkte für darüber hinausgehende Zeichen.

Ist mein Text privat, wenn ich die ASCII-Tabelle verwende?

Ja. Die gesamte Tabelle wird in Ihrem Browser in einfachem JavaScript generiert und jeder Text, den Sie in den Encoder einfügen, wird lokal verarbeitet - er wird nie hochgeladen, protokolliert oder gespeichert, und das Tool arbeitet weiterhin ohne Netzwerkverbindung, sobald die Seite geladen wurde.


Geschrieben von Liton, Erbauer von [Toolz.dev] (/, WP Adminify, und einer langen Reihe von Laravel- und React-Projekten, die früher oder später alle darauf hinausliefen, die Bytes richtig zu machen.

Comments

0 comments

0/2000 characters

No comments yet. Be the first to share your thoughts!