UTF-8-Byte-Rechner
Zähle Unicode-Zeichen und Bytes in UTF-8, UTF-16 und UTF-32. Vergleiche JavaScript-Codeeinheiten, Bytekosten und Unicode-Bereiche.
Häufige Fragen
Warum hat UTF-8 unterschiedlich viele Bytes pro Zeichen?
UTF-8 codiert Unicode-Codepunkte mit einem bis vier Bytes. ASCII-Zeichen benötigen ein Byte, viele lateinische Sonderzeichen zwei Bytes und Emojis meist vier Bytes. Dadurch bleibt englischer Text kompakt, während trotzdem alle Unicode-Zeichen unterstützt werden.
Warum unterscheidet sich JavaScripts string.length von der Zeichenanzahl?
JavaScript zählt bei string.length UTF-16-Codeeinheiten. Der String-Iterator zählt dagegen Unicode-Codepunkte. Ein Emoji kann deshalb als ein Zeichen erscheinen, aber zwei Codeeinheiten und vier UTF-8-Bytes belegen.
Wie viele Bytes braucht ein Emoji in UTF-8?
Ein einzelner Unicode-Codepunkt oberhalb von U+FFFF benötigt in UTF-8 vier Bytes. Zusammengesetzte Emojis können aus mehreren Codepunkten bestehen, etwa aus einem Familien-Emoji und mehreren Verbindern. Der Rechner zählt Codepunkte, nicht sichtbare Graphemcluster.
Was ist der Unterschied zwischen UTF-8, UTF-16 und UTF-32?
UTF-8 verwendet ein bis vier Bytes pro Codepunkt. UTF-16 verwendet zwei Bytes für Zeichen der Basisebene und vier Bytes für Surrogatpaare. UTF-32 verwendet immer vier Bytes pro Codepunkt. Der Rechner zeigt alle drei Größen nebeneinander.
Wo spielen Bytezahlen für Text eine Rolle?
Bytezahlen sind für HTTP-Übertragungen, Dateigrößen, Datenbankspeicher und bytebasierte Eingabelimits wichtig. Prüfe beim Zielsystem, ob es Zeichen, UTF-16-Codeeinheiten, Bytes, Token oder eine andere Einheit zählt.
Änderungsverlauf
Aktualisierungen von UTF-8-Byte-Rechner, nach Datum gruppiert.
1 Aktualisierung
UTF-8-Byte-Rechner hinzugefügt
- Zähle Unicode-Zeichen und Bytes in UTF-8, UTF-16 und UTF-32. Vergleiche JavaScript-Codeeinheiten, Bytekosten und Unicode-Bereiche.
Ähnliche Rechner
Weitere geprüfte Rechner im Themenbereich „Technik“.