WikiDer > EBCDIC
EBCDIC ("erweiterter binärcodierter Dezimalaustausch Code") ist ein 8-BitStandard zum Speichern von Buchstaben und Satzzeichen, entwickelt in 1963-1964 durch IBM für ihre Großrechner und AS/400-Computer. Der Code stammt aus der Verwendung von Lochkarten und gilt seit Jahren als veraltet; modernere Standards für die Darstellung von Charakteren umfassen ANSIA und Unicode.
Die 1-Byte-Version von EBCDIC verwendet acht Bits, die in zwei gleiche Teile von jeweils 4 Bit unterteilt sind. Die ersten 4 Bits, die Zone, repräsentieren die Zeichenkategorie; die letzten 4 Bits, die Digital, bezeichnen das bestimmte Zeichen. Es gibt eine Reihe von EBCDIC-Versionen, die je nach Land angepasst sind, um Sonderzeichen darzustellen. Einige asiatische Länder verwenden beispielsweise eine 2-Byte-Erweiterung von EBCDIC, um alle orientalischen Zeichen anzuzeigen. Sie verwenden das sogenannte Schichtcodes [0x0E,0x0F].
IBM hat alle Codepages mit einer Nummer identifiziert, die CCSID (Coded Character Set IDentifier).
Die EBCDIC-Zeichen sind wie folgt (gelb: spätere Ergänzungen):
| 0 | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 | 9 | ein | B | C | d | E | f | |||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 00 | NULL | SOH | STX | ETX | PF | HT | LC | DEL | SMM | VT | FF | CR | SO | SI | ||||
| 10 | DLE | DC1 | DC2 | TM | RES | NL | BS | IL | KÖNNEN | EM | CC | CU1 | IFS | IGS | IRS | IUS | ||
| 20 | DS | SOS | FS | BYP | LF | ETB | ESC | SM | CU2 | FRAGE | ACK | BEL | ||||||
| 30 | SYN | PN | RS | UC | EOT | CU3 | DC4 | NAK | SUB | |||||||||
| 40 | ein | ein | ein | ein | ein | ein | ç | ñ | ¢ [ | . | < | ( | | | |||||
| 50 | & | e | e | e | e | ich | ich | ich | ich | ß | ] | $ | * | ) | ; | ~ | ||
| 60 | - | / | EIN | EIN | EIN | EIN | EIN | EIN | Ç | Ñ | ¦ | , | % | _ | > | ? | ||
| 70 | Ö | E | E | E | E | ICH | ICH | ICH | ICH | ` | : | # | @ | ' | = | " | ||
| 80 | Ö | ein | b | c | d | e | f | G | ha | ich | « | » | ð | ý | þ | ± | ||
| 90 | ° | ja | k | l | ich | nein | Ö | p | q | r | ª | º | æ | ¸ | Æ | ¤ | ||
| A0 | µ | ~ | so | t | Sie | v | w | X | ja | z | ¡ | ¿ | Ð | Ý | Þ | ® | ||
| B0 | ¢ | £ | ¥ | · | © | § | ¶ | ¼ | ½ | ¾ | ¬ | | | ¯ | ¨ | ' | × | ||
| C0 | { | ein | B | C | d | E | f | G | huh | ich | - | Ö | Ö | Ö | Ö | Ö | ||
| D0 | } | J | k | l | ich | Nein | Ö | p | Q | R | ¹ | Sie | Sie | Sie | Sie | ÿ | ||
| E0 | ÷ | so | t | SIE | V | W | X | Ja | z | ² | Ö | Ö | Ö | Ö | Ö | |||
| F0 | 0 | 1 | 2 | 3 | 4 | 5 | 6 | 7 | 8 | 9 | ³ | SIE | SIE | SIE | SIE |
Dies ist CCSID 500, eine EBCDIC-Variante. Die Zeichen 0x00–0x3F und 0xFF sind Steuerzeichen, 0x40 ist ein Leerzeichen, 0x41 ist ein kein Pausenraum 0xCA ist a weicher Bindestrich.
Da ein Zeichen durch einen 4-Bit-Wert dargestellt wird, gibt es eine schöne Ähnlichkeit zwischen hexadezimal Zeichen und EBCDIC. Die Vertretung von uns Lateinisches Alphabet ist jedoch nicht durchgehend: zwischen den Zeichen ich und ja beispielsweise die Zeichen «, », ð, ý, þ, ±, °. Dies wirft eine Reihe schwieriger praktischer Probleme auf, beispielsweise bei der alphabetischen Sortierung von Daten.