Base64 und UTF-8-Zeichensätze
Base64 kodiert Bytes, keine Zeichen. UTF-8 wandelt Zeichen zuerst in ein oder mehrere Bytes um; chinesische Zeichen und Emoji nutzen mehrere. Eine Abweichung führt zu Mojibake oder Dekodierfehlern.
Einen expliziten Zeichensatz wählen
Dokumentieren Sie UTF-8 an jeder Browser-, API- und Datenbankgrenze. Dekodieren Sie Base64 zuerst zu Bytes und diese Bytes danach als UTF-8.
Eine Abweichung erkennen
Wenn ASCII funktioniert, akzentuierter Text aber fehlschlägt, prüfen Sie den deklarierten Zeichensatz, Zeilenumbruchumwandlungen und ob Standard-Base64 oder Base64URL verwendet wurde. Vergleichen Sie Bytelängen.
Praktischer Test
Kodieren Sie café / 世界 / 🚀 mit dem Textkodierer, dekodieren Sie es und vergleichen Sie die ursprünglichen Zeichen.