Kurz erklärt
Ein internationaler Standard, der jedem Zeichen aus praktisch jeder Schrift der Welt eine eindeutige Nummer (Codepoint) zuweist.
Genauer
Löst das Problem, dass ältere Zeichensätze (z. B. ASCII) nur wenige Zeichen abdeckten und für andere Sprachen/Symbole (Emojis, kyrillische oder asiatische Schriftzeichen) unbrauchbar waren. Wie diese Codepoints als Bytes gespeichert werden, regeln Kodierungen wie UTF-8 oder UTF-16 — Unicode selbst definiert nur die Zuordnung Zeichen ↔ Nummer, nicht das Byte-Format.