Hallo Forum,
ich habe hier noch zwei Aufgaben, die ich nicht verstehe. Könnte mir mal jemand sagen, wie man die löst?
Aufgabe 1)
Gegeben sei die folgende statistische Verteilung des Auftretens von Kodepositionen in Unicode. Die Kodepositionen sind hexadezimal, die Wahrscheinlichkeiten dezimal geschrieben.
Kodeposition Auftrittswahrscheinlichkeit
000000 <= x < 000080 40%
000080 <= x < 000800 30%
000800 <= x < 010000 20%
010000 <= x < 110000 10%
a) Berechnen Sie die mittlere Anzahl von Bytes pro Zeichen für UTF-8 und UTF-16
b) Kann es andere Verteilungen als die obige geben, bei denen die mittlere Anzahl vo nBytes pro Zeichen in UTF-16 geringer is als bei UTF-8 ?
Aufgabe 2)
In UTF-8 könnten bei Verwendung von n >= 2 Kodierungseinheiten prinzipiell von der zweiten bis zur n-ten Kodierungseinheit jeweils alle 8 Bits benutzt werden. Welchen Vorteil hat es, trotzdem die obersten beiden Bits fest mit dem Wert zu belegen und nur die unteren 6 Bits zu benutzen?