关于字符与字节计数器
本工具同时以四种方式统计你的文本——字符、UTF-8 字节、单词和行数——其中字节大小是大多数工具略过的部分。开发者和技术写作者在某物以字节而非字符计量时需要它:带字节限制的数据库列、API 字段上限、meta description 预算、配置值,或 JSON 载荷。把字符和字节并排看,能一眼看出非 ASCII 内容何时在悄悄多占空间。
工作原理
- 字符 统计 Unicode 码位,因此大多数表情符号和带重音字母算作一个。
- 字节(UTF-8) 将文本编码为 UTF-8 并测量实际字节长度——文本在文件、数据库或网络请求中占用的真实大小。
- 单词 按空白拆分。
- 行数 统计以换行分隔的行。
一切都随你输入或粘贴实时更新。
假设与行为
- 字节计数为 UTF-8,这是 Web、文件和大多数数据库的主流编码。在 UTF-8 中,纯 ASCII 字符各占 1 字节,常见带重音和希腊/西里尔字母占 2 字节,大多数其他文字占 3 字节,许多表情符号占 4 字节或更多。
- 字符按码位统计,这就是为什么当字符串包含非 ASCII 内容时,其字节数会远多于字符数。
- 单词以空白分隔;末尾的换行仍算作一行的结束。
局限
- 字符计数是码位,而非字素簇。 有些表情符号由多个码位构成(肤色变体、旗帜、家庭表情),因此它们即使渲染为单个字形,也可能算作多于一个"字符"。
- 字节数专指 UTF-8。 其他编码不同——UTF-16(JavaScript 内部使用)和旧式编码会给出不同的字节数。
- 短信长度与 UTF-8 字节不同。 短信使用 GSM-7 或 UTF-16 分段,因此请把这当作一般的大小参考,而非精确的短信分段计数器。
- 它测量大小;不校验或转换文本。
隐私
计数完全在你的浏览器中运行。你的文本绝不会被上传或存储。

