UTF-8 문자 집합
Base64는 문자가 아니라 바이트를 인코딩합니다. UTF-8은 먼저 문자를 하나 이상의 바이트로 바꿉니다. 중국어 문자와 emoji는 여러 바이트를 사용합니다. 불일치가 있으면 mojibake나 디코딩 오류가 납니다.
명시적 charset 선택
브라우저, API, 데이터베이스 경계마다 UTF-8을 문서화하세요. Base64를 먼저 바이트로 디코딩하고 그 바이트를 UTF-8로 해석하세요.
불일치 감지
ASCII는 되지만 악센트 문자가 실패하면 선언된 charset, 줄바꿈 변환, 생산자가 표준 Base64 또는 Base64URL 중 무엇을 썼는지 확인하세요. 바이트 길이도 비교하세요.
실전 확인
텍스트 인코더로 café / 世界 / 🚀를 인코딩한 뒤 디코딩해서 원래 문자와 비교하세요.