关于 HTML 编码 / 解码
本工具把在 HTML 中具有特殊含义的字符——<、>、&、"、'——转义为对应的实体,使它们显示为字面文本而非被解释为标记,并把实体反向解码还原。开发者和写作者用它来在网页上展示代码示例而不被浏览器渲染、把用户提供的文本安全地放入 HTML、修复双重编码的内容,或读取一段满是实体的字符串到底写了什么。
工作原理
- 编码 把五个对标记敏感的字符替换为其标准实体:
&→&、<→<、>→>、"→"、'→'。先处理&可避免对其余字符重复转义。 - 解码 使用浏览器自带的 HTML 解析器来解析实体,因此它不仅理解这五个,还理解像
©、 这样的命名实体以及像—这样的数字实体,把它们还原为真实字符。
两者都随你输入实时运行。
假设与行为
- 编码只针对五个特殊字符,它们对 HTML 的安全性和显示至关重要;普通字母、数字、标点和非 ASCII 文本保持原样(在 UTF-8 页面中无需转义)。
- 解码由浏览器驱动,因此它能处理全部命名和数字 HTML 实体,而不仅是编码器产生的那五个。
- 同时转义两种引号(
"和')使输出既可放入 HTML 属性值中,也可用于正文文本。
局限
- 编码不会把非 ASCII 转换为数字实体。 带重音字母和表情符号保持为字面字符,这对 UTF-8 页面是正确的,但如果你确实需要纯 ASCII、完全实体编码的输出,就不是你想要的。
- 这是 HTML 转义,而非清理(sanitisation)。 转义使文本可安全显示;它不会清理或校验你打算作为标记渲染的一段 HTML。
- 解码会解释它识别的任何实体,因此部分或格式错误的实体可能以浏览器认为合理的方式被解析,而非报错。
隐私
编码和解码完全在你的浏览器中运行。你的文本绝不会被上传或存储。

