UTF-8 Base64 인코더·디코더
이 도구는 텍스트를 UTF-8 바이트로 바꾼 뒤 표준 Base64 알파벳으로 표현합니다. 정규 형식의 Base64 문자열을 UTF-8 텍스트로 되돌릴 수도 있습니다. 처리는 브라우저 안에서 이루어지며 입력 텍스트를 SoupCalc 서버로 의도적으로 전송하지 않습니다.
인코딩 방법
RFC 4648 Base64는 3바이트(24비트)를 네 개의 6비트 값으로 나눠 4문자로 표시합니다. 표준 알파벳은 A–Z, a–z, 0–9, +, /이고 마지막 입력이 3바이트보다 짧으면 = 한두 개로 패딩합니다.
텍스트는 바이트가 되기 전에 문자 인코딩이 필요합니다. 이 구현은 항상 UTF-8을 사용해 비ASCII 텍스트도 예측 가능한 결과를 만듭니다. 디코더는 잘못된 입력을 조용히 허용하지 않고 표준 알파벳, 그룹 길이, 정규 패딩과 UTF-8 출력의 유효성을 검사합니다.
변환 예시
**Hello!**의 ASCII/UTF-8 6바이트는 SGVsbG8h로 인코딩됩니다.
유니코드도 같은 바이트 규칙을 따릅니다. 你好의 UTF-8 바이트는 5L2g5aW9이며 이 값을 디코딩하면 원래 두 한자가 돌아옵니다.
입력 3바이트가 출력 4문자가 되므로 Base64는 보통 크기를 약 3분의 1 늘립니다. 작은 입력은 패딩의 영향이 더 큽니다.
결과의 의미
Base64는 바이트를 운반하기 위한 표현입니다. 텍스트 전용 필드가 바이트 데이터를 담아야 할 때 유용하지만 수신자는 디코딩한 바이트가 UTF-8 텍스트인지 이미지인지 다른 형식인지 알아야 합니다.
이 페이지는 텍스트에 한정되어 유효한 UTF-8을 만드는 값만 디코딩합니다. 일반 바이너리 파일 인코더가 아니며 -, _를 사용하고 패딩 관례가 다를 수 있는 URL-safe Base64가 아니라 표준 알파벳을 사용합니다.
한계와 보안
- Base64는 암호화가 아닙니다. 기밀성, 인증, 무결성 보호 또는 비밀번호 해싱을 제공하지 않으며 값을 가진 사람은 일반적으로 해독할 수 있습니다.
- 실행 환경을 이해하지 못한 상태에서 온라인 도구에 비밀을 붙여 넣지 마십시오. 브라우저 로컬 처리는 네트워크 노출을 줄일 뿐 확장 프로그램, 감염된 기기, 복사 기록, 화면 캡처와 다른 로컬 접근을 막지 못합니다.
- 디코더는 공백, 알파벳 밖 문자, 잘못 놓였거나 빠진 패딩, 비정규 인코딩과 유효하지 않은 UTF-8 바이트를 거부합니다. 다른 도구가 허용한다고 해서 이 페이지의 정규 입력이 되는 것은 아닙니다.
- Base64는 데이터를 압축하지 않습니다. 큰 파일에는 원본 바이트를 보존하고 무결성을 확인하는 파일 전용 절차를 사용하십시오.
출처
- RFC 4648, The Base16, Base32, and Base64 Data Encodings — 표준 알파벳, 그룹화, 패딩과 디코더 요구사항.
- WHATWG Encoding Standard — 웹 플랫폼 텍스트 인코더·디코더가 사용하는 UTF-8 및 오류 처리 모델.
편집 기록
- 작성: SoupCalc 편집팀
- 방법 검토: SoupCalc 엔지니어링·보안 검토
- 검토일: 2026년 8월 11일
- 범위: UTF-8 변환, 정규 RFC 4648 동작, 예시, 브라우저 데이터 처리와 보안 경계