UTF-8 Base64 编码与解码器
这个工具先用 UTF-8 把文本转换为字节,再使用标准 Base64 字母表表示这些字节。它也能把规范的 Base64 字符串还原为 UTF-8 文本。处理过程在浏览器本地完成,工具不会主动把输入文本发送到 SoupCalc 服务器。
编码方法
RFC 4648 Base64 把三个字节共 24 位分成四组 6 位值,再表示为四个字符。标准字母表由 A 至 Z、a 至 z、0 至 9、+ 和 / 组成。最后一组不足三个字节时,会使用一个或两个 = 字符补齐。
文本必须先采用字符编码才能形成字节。本程序始终使用 UTF-8,因此非 ASCII 文本也有确定结果。解码器会检查标准字母表、分组长度、规范填充和 UTF-8 输出,不会悄悄接受格式错误的输入。
完整示例
文本 Hello! 对应六个 ASCII 与 UTF-8 字节,编码结果是 SGVsbG8h。
Unicode 文本也采用相同的字节规则。你好的 UTF-8 字节编码为 5L2g5aW9,解码这个值会返回原来的两个汉字。
三个输入字节变成四个输出字符,因此 Base64 通常会使体积增加约三分之一。输入很短时,填充字符带来的比例影响会更明显。
如何理解结果
Base64 是字节的传输表示,可用于只能承载文本的字段。接收方仍需知道解码后的字节代表 UTF-8 文本、图像还是其他数据。
本页只面向文本,只接受能够产生有效 UTF-8 的解码结果。它不是通用二进制文件编码器,采用的也是标准字母表,不支持用 - 和 _ 替换字符且填充约定可能不同的 URL 安全 Base64。
限制和安全说明
- Base64 不属于加密,不会提供保密、身份验证、完整性保护或密码哈希,拿到字符串的人通常都能解码
- 除非了解运行环境,否则不要把秘密粘贴到在线工具。浏览器本地处理能减少网络暴露,但无法防范浏览器扩展、设备入侵、剪贴板历史、截图或其他本地访问
- 解码器会拒绝空白、字母表外字符、位置错误或缺失的填充、非规范编码,以及不能形成有效 UTF-8 的字节序列。其他工具接受某个值,并不能证明该值在这里属于规范输入
- Base64 不会压缩数据。处理大文件时,应使用能够保留原始字节并校验完整性的文件工具
资料来源
- RFC 4648 Base16、Base32 和 Base64 数据编码,用于核对标准字母表、分组、填充和解码要求。
- WHATWG 编码标准,用于核对网页文本编码器和解码器采用的 UTF-8 及错误处理模型。
编辑记录
- 作者为 SoupCalc 编辑团队
- 方法复核由 SoupCalc 工程与安全审查完成
- 最后复核日期为 2026 年 8 月 10 日
- 复核范围包括 UTF-8 转换、RFC 4648 规范行为、示例、浏览器数据处理和安全边界