Base64 教程中心

Base64 与 UTF-8 字符集

Base64 编码的是字节而不是字符。UTF-8 会把一个字符转换为一个或多个字节,中文和 emoji 通常占用多个字节;步骤不一致就会出现乱码。

明确声明字符集

浏览器、接口和数据库之间都应约定 UTF-8。解码时先得到字节,再按 UTF-8 转成文字,不要把任意字节直接当作字符串。

排查方法

如果 ASCII 正常而中文失败,应检查 charset、换行转换、标准 Base64 与 Base64URL 的差异,并比较字节长度。

往返测试

使用文本编码器测试“café / 世界 / 🚀”,再解码并逐字符比较。