将 HTML 实体引用还原为字面 Unicode 字符——实体编码的逆操作。
支持的形式
- 命名实体 —
&、<、>、"、'及其他常见名称 - 十进制数字实体 —
é→ é - 十六进制数字实体 —
'→ 撇号
解码器扫描 &…; 序列并在识别时替换;未识别的序列保持原样,便于发现拼写错误。
适用场景
阅读 CMS 导出的 HTML、从 XML 源恢复原始标点,或用配套的「文本转实体」工具验证往返结果。
限制
畸形实体(缺少分号、未知名称)可能仍部分保持编码。本工具不解析完整 HTML 文档,也不剥离标签——仅对粘贴的字符串做实体替换。安全提示:在注入 HTML 前解码不可信实体,若随后跳过转义,可能重新引入标记。
示例
例如,在表单中输入默认示例值,并与已知参考对照;每次只改一项输入,观察结果如何变化。