Wir betrachten drei grundlegende Codierungen, auf die Java‑Entwicklerinnen und ‑Entwickler stoßen: Was ist
UTF-8 (Standard für das Web und die meisten Formate), wie ist das interne Zeichenkettenformat in der JVM aufgebaut —
UTF-16 (mit Surrogatpaaren und
BOM) und warum begegnet uns
ISO-8859-1 immer noch. Wir erläutern die Kompatibilität mit
ASCII, die Byte‑Größe pro Zeichen und zeigen die korrekte Arbeit mit Codierungen in Java mittels
StandardCharsets,
Files.write,
Files.readString,
Paths.get. Am Ende — typische Fehler: falsches Lesen/Schreiben, systemseitige Standardkodierung, Verwechslung von
UTF-16/
UTF-8.