ASCII und UNICODE einfach erklärt! Programmieren Starten https://www.youtube.com/watch?v=Vs9CMqr4PUQ Transkript (automatisch erstellt) 0:00 hallo und herzlich willkommen auf dem youtube-kanal von programmieren - starten punkt.de mein name ist jannik grün und heute schauen wir uns mal die 0:08 ascap und unico zeichensätze an ich habe ja vor kurzem erst ein video über die verschiedenen zahlen systeme gemacht darunter auch das binärsystem 0:16 und da dachte ich mir hey wenn ich diese grundlagen schon behandelt habe da kann ich auch eigentlich mal über zeichen codierung entsprechen und das mache ich 0:24 heute fahren wir also einfach mal an mit der einfachsten zeichen codierung namens ascii was ist also ascii mit ascii ist es möglich verschiedene zeichen also zum 0:34 beispiel buchstaben satzzeichen die ziffern 0 bis 9 und so weiter mit hilfe einer zahl genauer gesagt einer binär zahl darzustellen mit einem zeichensatz 0:44 via ski wird also festgelegt welcher byd wert als welches zeichen dargestellt werden soll in einem text in der ascii tabelle ist das große art zum beispiel 0:53 die zahl 65 als dezimalzahlen ascii ist eine 7 bezeichen codierung das heißt die ascii tabelle umfasst 128 mögliche zeichen 1:04 und wenn wir jetzt das große aber welches jahr die 65 in der ski tabelle ist als eine binär zahl darstellen wollen dann nehmen wir einfach 7 biz und 1:13 stellen davon das erste und das letzte bild auf den wert 1 die anderen bleiben eine null und so hast du den großbuchstaben als eine biene zahl 1:21 dargestellt mit hilfe der ascii tabelle das ist an sich ja ganz schön und einfach wir haben die ascii tabelle und in der ascii tabelle hat jeder darin 1:28 enthaltende buchstaben oder jedes zeichen allgemein einen leitwert und mit diesen beiden werten kann man texte damit schreiben aber in dieser ascii 1:37 zeichen codierung haben wir auch nur 128 mögliche zeichen die wir schreiben können da passt zum beispiel das lateinische alphabet und somit auch das 1:44 englische alphabet rein weil diese übereinstimmen pasta komplett rhein mit allen klein und großbuchstaben auch die ziffern 0 bis 9 einige satzzeichen und 1:52 auch codes für tastatureingaben haben darin platz aber alphabete jetzt aus anderen ländern finden in dieser 7 bezeichen codierung 1:59 keinen platz und das ist ein problem auch unsere umlaute die während der deutschen sprache haben oder haben darin keinen platz und deswegen gibt es weiter 2:08 entwickelte zeichen setzte die mehr bits nutzen pro buchstaben und diese weiter entwickelten einsätze sind in der regel auch 2:15 abwärtskompatibel zu us-team das heißt sie haben als erste 128 zeichen die ascii tabelle ganz normal übernommen und alles was danach noch an platz da ist 2:24 wird für weitere zeichen verwendet zum beispiel gibt es eine erweiterung zum ascii codes namens anziehen anziehen nutzt einfach noch den übrig gebliebenen 2:32 8-bit der in der ascii tabelle nicht verwendet wird und damit werden noch weitere nützliche zeichen wie zum beispiel unsere umlaute hinzugefügt die 2:41 anzieht tabelle hat also statt 128 zeichen durch das letzte achtel bis das hinzugefügt wurde ganze 256 unterstützte zeichen und das 2:50 ist natürlich schon ein bisschen mehr ich möchte dir an dieser stelle auch mal zeigen dass man wirklich sehen kann dass einzelne zeichen in der anzieht tabelle 2:59 nur ein byte groß sind indem wir hier mal einfach ein textdokument erstellen ich habe jetzt hier in windows ein ganz einfaches text 3:05 dokument erstellt das kann man auch mal anklicken das ist komplett leer und wenn wir jetzt mal hier einen rechtsklick drauf machen und auf die 3:11 eigenschaften gucken dann sehen wir das ist eine größe von 0 bei aktuell hat ich meine da steht ja auch gar nichts drin bisher eigentlich ganz klar wenn wir 3:19 jetzt hier aber mal einen buchstaben reinschreiben zb das große ab und wenn wir jetzt hier sagen okay wir gehen auf speichern unter und nutzen als codierung 3:30 hier anzieht das können wir hier auswählen dann drücken wir auf speichern und sagen ja wir wollen das überschreiben und dann 3:38 einen rechtsklick hier drauf machen dann sehen wir dass das ganze einen beitritt groß ist wenn wir hier noch ein weiteres zeichen hinzufügen dann wird das ganze 3:48 um einen bart wachsen ich hab's gespeichert wir schließen es wieder drücken wieder auf eigenschaften und sehen dass das ganze jetzt zwei bereits 3:56 großes und ja hier nutzen wir jetzt die anzeichen codierung das heißt wenn wir hier jetzt zum beispiel umlaute machen wollen dann geht das weil in der anti 4:05 tabelle anders als in der ascii tabelle werden solche umlaute die wir hier in der deutschen sprache auch haben unterstützt 4:11 und ja das ist die anzeichen codierung nebenan sie gibt es jetzt aber noch einen weiteren zeichensatz der heute weltweit verwendung findet und zwar den 4:23 unico zeichensatz mit unicode wird versucht alle weltweit bekannten textzeichen in einem einzigen zeichensatz zusammenzufassen 4:31 während ascii also nur das lateinische alphabet beinhaltet enthält unicode auch zum beispiel das griechische kyrillische arabische und viele weitere alphabete 4:40 außerdem enthält der unico zeichensatz energies und viele technische oder kaufmännische sonderzeichen das ist übrigens auch der grund warum 4:48 man hier auf youtube in den kommentaren in mogi schreiben kann denn über 90 prozent aller websites nutzen als zeichen codierung etf 8 4:56 welches die am meisten verbreitete codierung von unicode ist das tolle an etf 8 ist dass man damit alle unicode zeichen darstellen kann es allerdings 5:04 trotzdem pro zeichen nur so viel speicherplatz braucht wie wirklich benötigt wird wenn man also einen buchstaben 5:10 darstellen will der bereits in der ascii tabelle definiert ist dann wird dafür nur ein weit benötigt wenn ein buchstabe jetzt allerdings vier braucht dann 5:18 kriegt er eben seine vier einzelne zeichen werden den etf 8 also mit einer variablen länge codiert und so muss man nicht für jedes einzelne zeichen 5:27 unmengen an unnötigen bytes hernehmen neben etf 8 gibt es natürlich auch noch andere unicode zeichen formate wie ots 16 zum beispiel mit welchen sich 5:36 natürlich auch alle unicode zeichen abbilden lassen und ef 8 ist aber dass weltweit verbreitetste ich möchte dir natürlich auch zeigen dass man auch hier 5:45 im text editor ots acht verwenden kann und die auswirkungen davon möchte ich dir natürlich hier auch mal zeigen aktuell haben wir hier noch unsere selbe 5:53 textdatei die vorhin auch diese textdatei wird gerade noch im anti format codiert das heißt wenn wir hier jetzt mal aus der zwischenablage einen 6:02 regenschirm einpacken der eigentlich nur im unicode zeichen satz zb etf 8 verfügbar ist und das ganze dann speichern als anzieht dann kriegen wir 6:12 hier eine fehlermeldung dass dieses zeichen auch verloren gehen kann wenn wir jetzt hier als anzieht das ganze speichern 6:18 wir speichern sie aber trotzdem und wenn wir jetzt hier das ganze öffnen dann steht hier nur noch ein fragezeichen denn dieses zeichen der regenschirm 6:27 der kann hier in eine an sie dateien natürlich nicht rein gespeichert werden weil in der anti tabelle dieser regenschirm gar nicht existiert wenn wir 6:35 den regenschirm ist hier aber noch mal reinpacken und das ganze dann über speichern unter als etf acht text speichern und das 6:45 ganze land schließen dann sehen wir dass dieser regenschirm hier noch da ist weil hier wird dieser regenschirm metz auch unterstützt das in 6:53 diesem zeichensatz vorhanden löschen wir den regenschirm mal und speichern wir das ganze noch mal und schauen wir uns mal an wie groß die datei aktuell ist 7:03 aktuell haben wir jetzt hier eine ot f8 datei gehen wir auf eigenschaften und dann sehen wir das selbst wenn der text leer ist hier drei bonn von anfang an 7:13 beansprucht werden wenn wir jetzt hier ein paar einschreiben ein großes dann müsste ein byte dazu kommt denn das a ist in der ascii tabelle vorhanden und 7:24 dafür wird nur ein byte benötigt speichern wir das ganze mal und dann müssen wir jetzt hier eine datei haben die vier beim großes und siehe da wir 7:33 haben vier bei wenn wir jetzt aber den regenschirm nochmal hinzufügen dann werden wir sehen dass der regenschirm mehr platz benötigt als 7:42 dieses a denn für den brauchen wir zum darstellen mehr speichern wir das ganze mal aktuell mit dem a nur waren sie jetzt vier 7:51 beisitzer haben wir den regenschirm hinzugefügt man schauen wie groß es jetzt ist und siehe da jetzt ist diese datei 71 groß also der regenschirm 8:00 alleine hat drei beansprucht und ja das sind diese auswirkungen über die man sich natürlich im klaren sein muss wenn man mit solchen zeichen setzen arbeitet 8:11 und ja das war es auch eigentlich schon mit dieser kleinen einführung in die welt der zeichen codierung ich hoffe du hast das thema interessant gefunden 8:18 und wenn du programmieren lernen möchtest in zb sap oder java wap dann klicke jetzt mal auf den link in der video beschreibung um zu unserer website 8:26 www.pro gramm ihren - staaten punkt.de zu gelangen dort gibt es sehr umfangreiche video kurse zu diesem programmiersprachen in 8:33 welchen durch schritt für schritt an die programmierung herangeführt wirst und somit auch schnell deine eigene software schreiben kannst wenn du wirklich 8:39 programmieren lernen willst dann klicke also auf den link in der video beschreibung und ja in diesem sinne war es das mit diesem video 8:45 wenn ihr das video gefallen hat dann würden wir uns selbstverständlich über einen daumen nach oben freuen und falls es noch nicht getan 8:51 dann abonniere unseren youtube channel um nichts mehr zu verpassen wir bringen regelmäßig neue videos zu den verschiedensten programmier- 8:57 bezogenen themen und wenn das genau dein ding ist dann das auf jeden fall ein abo da in diesem sinne verabschiede ich mich und wünsch dir jetzt auch einen 9:04 wunderschönen tag auf wiedersehen