Sobre o contador de caracteres e bytes
Isso conta seu texto de quatro formas ao mesmo tempo — caracteres, bytes UTF-8, palavras e linhas — sendo o tamanho em bytes a parte que a maioria das ferramentas pula. Desenvolvedores e redatores técnicos precisam dele quando algo é medido em bytes em vez de caracteres: uma coluna de banco de dados com limite de bytes, um teto de campo de API, um orçamento de meta descrição, um valor de configuração, ou um payload JSON. Ver caracteres e bytes lado a lado deixa óbvio quando o conteúdo não ASCII está silenciosamente consumindo espaço extra.
Como funciona
- Caracteres conta pontos de código Unicode, então a maioria dos emojis e letras acentuadas conta como um.
- Bytes (UTF-8) codifica o texto como UTF-8 e mede o comprimento real em bytes — o tamanho real que o texto ocupa em um arquivo, banco de dados ou requisição de rede.
- Palavras divide por espaços em branco.
- Linhas conta as linhas separadas por quebras de linha.
Tudo atualiza ao vivo enquanto você digita ou cola.
Suposições e comportamento
- A contagem de bytes é UTF-8, a codificação dominante para a web, arquivos e a maioria dos bancos de dados. Em UTF-8, caracteres ASCII simples são 1 byte cada, letras acentuadas comuns e gregas/cirílicas 2 bytes, a maioria das outras escritas 3 bytes, e muitos emojis 4 bytes ou mais.
- Caracteres são contados como pontos de código, e é por isso que uma string pode ter muito mais bytes que caracteres quando contém conteúdo não ASCII.
- Palavras são separadas por espaço em branco; uma quebra de linha final ainda conta como fim de uma linha.
Limitações
- A contagem de caracteres são pontos de código, não clusters de grafemas. Alguns emojis são construídos de vários pontos de código (variantes de tom de pele, bandeiras, emojis de família), então podem contar como mais de um "caractere" mesmo renderizando como um único glifo.
- A cifra de bytes é especificamente UTF-8. Outras codificações diferem — UTF-16 (que o JavaScript usa internamente) e codificações legadas dariam contagens de bytes diferentes.
- O comprimento de SMS não é o mesmo que bytes UTF-8. Mensagens usam segmentação GSM-7 ou UTF-16, então use isto como um guia geral de tamanho, não como um contador exato de segmentos SMS.
- Ele mede o tamanho; não valida nem transforma o texto.
Privacidade
A contagem roda inteiramente no seu navegador. Seu texto nunca é enviado ou armazenado.

