将文本与Unicode转义序列(如\uXXXX格式)进行双向转换的工具。
工具用的顺手吗?
你的反馈能帮助我们做得更好
概览
了解工具能解决的问题、计算或处理逻辑,以及数据边界。
输入“Hello 你好”并保持默认设置,结果是 Hello \u4f60\u597d:ASCII 范围内的字母和空格保留原样,中文字符改写为反斜杠、字母 u 与四位十六进制数字组成的转义单元。切换到解码后,相同序列会还原为可读文字。这里做的是字符转义表示,不是加密,也不是把文字转换成 UTF-8 字节或十六进制字节流。
你 的 UTF-16 代码单元为十六进制 4f60,因此显示为 \u4f60;A 的代码单元为 0041。解码只替换形如 \u 后紧跟四位十六进制数字的片段,十六进制字母大小写均可。普通文字会保留,格式不完整的片段也不会被自动猜测或补齐。因此,name=\u5f20 可以得到 name=张,而 \u5f2 会原样留下。
默认状态只转义代码单元值大于 127 的字符,所以英文、数字和常见 ASCII 标点通常保持可读。开启“编码所有字符”后,ASCII 也会写成四位形式,例如 A 变为 \u0041,空格变为 \u0020。该开关不会改用花括号形式,也不会生成 U+XXXX、HTML 字符引用或百分号编码。
表情符号和部分古文字位于基本多文种平面之外,需要两个 UTF-16 代理代码单元。实际复核中,😀 编码为 \ud83d\ude00,解码这两个连续单元可恢复原字符。单独出现的高代理或低代理不是完整字符,跨系统传递时不应拆开这一对。
\uXXXX 与辅助平面字符使用 UTF-16 代理对的结论;标准发布于2017年12月,核验日期为2026-09-22。指南
按步骤完成操作,并通过示例核对输入与结果。
原文转转义序列时选“编码”;已有 \uXXXX 文本需要恢复时选“解码”。切换方向后,示例按钮也会给出对应方向的输入。
把纯文本或转义文本放入输入区。结果会随输入和开关变化自动生成;输入为空时,输出也为空。
只想处理中文、重音字母和表情时保留默认;需要每个 UTF-16 代码单元都写成四位形式时开启“编码所有字符”。
特别检查反斜杠数量、表情是否形成两个连续代理单元,以及目标系统究竟需要转义后的源码文字还是已经解码的字符。输出区可直接复制。
场景
查看这项工具在不同工作与生活流程中的用法。
接口日志把中文显示成 \uXXXX 时,可先解码确认实际字段内容;准备测试数据时,也可把非ASCII字符转为同类转义形式。
开发者可比较默认模式与全字符模式,确认目标语言、配置文件或测试用例对反斜杠的要求。若外层格式还会解释一次转义,需要另外处理双反斜杠。
同一段文字混有拉丁字母、中文与表情时,保留ASCII能突出非ASCII部分;全字符编码则便于逐个检查代码单元。
问答
集中解答高频疑问与容易混淆的问题。
默认只转换代码单元值大于127的字符。开启“编码所有字符”后,英文和空格也会变成 \uXXXX。
该字符超出基本多文种平面,四位格式需要用一对 UTF-16 代理代码单元表示。这两个单元应连续保存和解码。
\u{1F600}、U+1F600 或 \x41 吗?不能。当前解码规则只识别反斜杠、小写 u 与恰好四位十六进制数字;其他表示会保留原样。
解码会替换所有匹配片段,而不是把整段输入当成必须完全合规的文档。因此有效片段可被替换,不匹配的片段继续保留,使用者需要自行检查混合结果。
须知
使用前了解适用范围、结果限制与必要提醒。
输出是 UTF-16 代码单元的
\uXXXX文本表示,不是Unicode码点列表、字符集转码结果、URL编码或加密结果。不要把可读性变化当作保密措施。
U+1F600、按UTF-8字节查看,或进行规范化比较时,应选用相应任务的方法,不能从四位转义外观直接推断字节内容。推荐
查找相关工具、专题与可用的 API 能力。