Zum Inhalt springen
L

Wikipedia · einfach zusammengefasst · Stand

Zeichensatz

Traditionell in der Informatik bekannte Zeichenkodierungen sind der ASCII- und der EBCDIC-Code. Letzterer hat allerdings stark an Bedeutung verloren …

Inhalt6 Abschnitte
  1. 1. Grundbegriff und Bedeutung
  2. 2. Zeichenkodierungen in Computersystemen
  3. 3. Internationale Standards
  4. 4. Nationale und sprachbezogene Varianten
  5. 5. Firmenspezifische Zeichensätze
  6. 6. Zeichen in wissenschaftlichen Formalismen

Grundbegriff und Bedeutung

Ein Zeichensatz ist der Vorrat an kleinsten Einheiten einer Schrift, den sogenannten Schriftzeichen. Aus diesen Zeichen lassen sich Zeichenketten zusammensetzen. Zu einem Zeichensatz können Buchstaben eines Alphabets, Ziffern, Sonderzeichen, Zeichen der Lautumschrift des IPA-Codes, Zeichen der Brailleschrift, Piktogramme und Steuerzeichen gehören.

Ein Zeichensatz ist von einem Zeichencode zu unterscheiden. Ein Zeichencode enthält zusätzlich eine festgelegte Nummerierung der Zeichen. Beispiele wie ASCII sind deshalb streng genommen bereits Zeichencodes. In der Informationstechnik reicht die bloße Festlegung der vorhandenen Zeichen nicht aus: Jedes Schriftzeichen muss nummeriert sein, damit ein Computer es verarbeiten und übertragen kann. Für den Datenaustausch im Internet sind international genormte Zeichencodes besonders wichtig. Dadurch wurde die frühere Vielfalt unterschiedlicher Codes stark reduziert.

Die sichtbare grafische Form eines einzelnen Zeichens heißt Glyphe. Die grafische Gestaltung eines vollständigen Zeichensatzes wird als Schriftart bezeichnet; diese kann in einem bestimmten Schriftstil vorliegen. Regeln für das Setzen von Satzzeichen nennt man Interpunktionsregeln.

Zeichenkodierungen in Computersystemen

Traditionell waren in der Informatik besonders ASCII und EBCDIC bekannt. EBCDIC hat inzwischen stark an Bedeutung verloren. Wichtiger wurden Kodierungen, die über die Zeichen des Englischen hinausgehen und international benötigte Schriftzeichen enthalten. Dazu gehören Zeichensätze gemäß ANSI und vor allem der international anerkannte Standard Unicode.

ASCII wurde 1963 eingeführt. Es verwendet 7 Bit, besitzt 128 Codepoints und enthält 95 darstellbare Zeichen. Es wurde durch ANSI X3.4-1968 genormt und zuerst beim Fernschreiber Teletype ASR-33 eingesetzt.

EBCDIC wurde 1964 eingeführt. Es verwendet 8 Bit und umfasst 256 Codepoints, von denen je nach Ausführung 93 bis 192 Zeichen darstellbar sind. Der Code wurde vor allem auf IBM-Großrechnern eingesetzt.

Unicode wurde 1991 eingeführt. Es verwendet einen 21-Bit-Coderaum mit 1.114.112 Codepoints. Unicode 8.0 umfasste 120.737 darstellbare Zeichen. Unicode steht in Verbindung mit der Norm ISO 10646; als erste Einsatzbereiche nennt der Artikel Xerox und Apple.

Die Anzahl der darstellbaren Zeichen ist kleiner als die Gesamtzahl der vorgesehenen Zeichen, weil ein Teil des Zeichenvorrats anderen Zwecken dient. Dazu zählen insbesondere nicht druckbare Steuerzeichen. Der Teil der Computerhardware, der Zeichen auf einem Bildschirm oder Plotter sichtbar macht, heißt Zeichengenerator.

Internationale Standards

Mehrere internationale Standards regeln die Verarbeitung und den Austausch von Zeichen:

• ASCII gehört zu den ältesten Computerzeichensätzen und stammt aus dem Jahr 1963.

• ISO 646 definiert seit 1972 nationale Varianten von ASCII in einer 7-Bit-Kodierung.

• Die 1986 eingeführte ISO/IEC-8859-Familie besteht aus 15 verschiedenen Zeichenkodierungen. Sie deckt alle europäischen Sprachen sowie Arabisch, Hebräisch, Thailändisch und Türkisch ab.

• Unicode und ISO/IEC 10646 bilden seit 1991 den internationalen Standard, auf dem fast alle modernen Computer basieren.

• DIN 91379 ist seit 2022 eine Teilmenge von Unicode. Sie dient der elektronischen Verarbeitung von Namen und dem Datenaustausch in Europa.

Nationale und sprachbezogene Varianten

Neben internationalen Standards gibt es Zeichensätze und Kodierungen für bestimmte Sprachen oder Schriftsysteme. ARMSCII dient dem Armenischen. Big5 erfasst traditionelle chinesische Schriftzeichen und wird in Taiwan sowie von Auslandschinesen verwendet. Guojia Biaozhun (GB) ist für vereinfachte chinesische Schriftzeichen bestimmt. HKSCS ist ein 1999 entstandener Standard aus Hongkong für Kantonesisch.

DIN 66003 ist eine 1974 festgelegte deutsche nationale Variante von ISO 646. EUC, ausgeschrieben Extended UNIX Coding, umfasst mehrere ostasiatische Sprachen. GEOSTD dient dem Georgischen, ISCII allen indischen Sprachen und TSCII dem Tamil. KOI8-R ist für Russisch, KOI8-U für Ukrainisch und VISCII für Vietnamesisch bestimmt.

Shift-JIS, auch SJIS genannt, ist eine von Microsoft entworfene japanische Kodierung. TIS-620 wurde 1990 für Thailändisch eingeführt und ähnelt ISO 8859-11.

Firmenspezifische Zeichensätze

Computerfirmen entwickelten verschiedene eigene, teilweise proprietäre Zeichensätze. EBCDIC wurde 1964 von IBM entwickelt. Apple nutzte vor Mac OS X unter anderem Macintosh Roman und MacCyrillic; Mac OS X verwendet Unicode.

PETSCII ist der Zeichensatz der 8-Bit-Computer von Commodore. Der Zeichensatz der 16-Bit-Commodore-Computer Amiga wurde von ISO-8859-1 abgeleitet. Zu den Systemen von Microsoft gehören Windows- und DOS-Codepages, beispielsweise Windows-1252, MS-DOS Codepage 437 und Codepage 850. Außerdem wird die Windows Glyph List 4 genannt.

Zeichen in wissenschaftlichen Formalismen

Auch wissenschaftliche Formalismen beruhen auf festgelegten Zeichenvorräten. Typische Beispiele sind die Einheitenzeichen für Einheiten physikalischer Größen sowie Formelzeichen und mathematische Symbole. Solche Zeichensätze ermöglichen es, Größen, Beziehungen und mathematische Ausdrücke mit einheitlich verwendeten Zeichen darzustellen.

Weiterlesen

Symbol Religiöse Symbole sind konstitutive Elemente religiöser Identifikation, Sprache und Handlungen. ... Mythen, Symbole und Zeichen in Kultur, Religion, Kunst … Lautschrift Eine Lautschrift (auch phonetische Schrift) ist ein Schriftsystem mit dem Zweck, die Aussprache von Lauten oder Lautketten wiederzugeben – möglichst exakt … Piktogramm Ein Piktogramm kann aus einer ikonischen Darstellung von Objekten, Szenen, abstrakten Symbolen, Zahlen oder Textelementen bestehen. Typischerweise ist ein … Steuerzeichen Durch Steuerzeichen ist es möglich, Steuerungsbefehle für die Ausgabegeräte innerhalb des Zeichensatzes zu übertragen, anstatt die Steuerungsinformationen über … Zeichenkodierung Eine Zeichenkodierung (englisch character encoding, kurz encoding) erlaubt die eindeutige Zuordnung von Schriftzeichen (i. A. Buchstaben oder Ziffern) und … American Standard Code for Information Interchange Der American Standard Code for Information Interchange (ASCII, alternativ US-ASCII, ausgesprochen [ˈæski], deutsch „Amerikanischer Standard-Code für den … Informationstechnik Informationstechnik (kurz IT) steht für die Technik zur Elektronischen Datenverarbeitung (EDV) und der hierzu verwendeten Hard- und Software-Infrastruktur. Interpunktion Interpunktion ; Fragezeichen ? ; Ausrufe‑, Ausruf‑, Rufzeichen ! ; Apostroph, Hochkomma, ' ; ‐ - Bindestrich; Trennstrich; Ergänzungsstrich. Einheitenzeichen Das Einheitenzeichen, auch Einheitenkürzel, ist das Symbol für eine Maßeinheit. Maßeinheit und Zahlenwert, die sogenannte Maßzahl, bezeichnen zusammen die … Unicode [ ˈjuːnikoːt]) legt fest, wie Schrift elektronisch gespeichert werden kann, z. B. auf einem Computer oder Telefon. Der durch den Standard festgelegte … Anzahl Der gleichbedeutende stochastische Begriff zu Anzahl ist absolute Häufigkeit. Die Bezeichnung absolute Häufigkeit lässt sich ebenso wie die Bezeichnung … Hardware Unterteilung · Ausgabegeräte (Drucker, Bildschirm, Beamer, Lautsprecher …) · Eingabegeräte (Tastatur, Maus, Joystick …) · Einlesegeräte (Mikrofone, …