Resultado
Esta página não tem lado servidor nenhum. A tabela colada é processada por JavaScript dentro do seu próprio navegador, o gráfico é desenhado num elemento canvas da sua máquina e o arquivo de exportação é montado localmente. Nada é enviado, armazenado ou gravado em qualquer log. Você pode desconectar a rede depois que a página carregar e tudo continuará funcionando — é a forma mais simples de verificar você mesmo.
Fatos e limites do método
| Alfabeto | a-z, A-Z — as 26 letras do alfabeto inglês em ambos os casos |
|---|---|
| Faixa Unicode | U+0041–U+005A e U+0061–U+007A — latino básico ASCII |
| Não conta como letra | Dígitos, espaços, pontuação, cirílico, emojis |
| Maiúsculas/minúsculas | Letras maiúsculas e minúsculas contam igual, o caso não afeta o total |
| Letras acentuadas | é, ñ, ü e outras letras latinas estendidas fora de a-z/A-Z não são contadas |
| Velocidade | Recalcula a cada tecla digitada, sem atraso, e o texto nunca sai do navegador |
Quando induz ao erro
- A ferramenta detecta apenas letras latinas básicas com o padrão [a-zA-Z]. Letras latinas estendidas com diacríticos — francesas é, è, ç, alemãs ä, ö, ü, ß, espanholas ñ, á — ficam fora da contagem mesmo parecendo visualmente letras latinas comuns.
- Palavras mistas são contadas apenas parcialmente: em «email-адрес» só as letras de «email» são contadas, enquanto «адрес» entra na contagem cirílica e o hífen vai para «outros caracteres».
- Abreviações e códigos em escrita latina (URLs, nomes de marcas, tags HTML dentro do texto) são contados como palavras comuns — a ferramenta não tem noção de contexto, apenas compara caracteres.
- Números romanos (IV, XX, MCM) são na verdade formados pelas letras latinas I, V, X, L, C, D, M, então a ferramenta os conta corretamente como letras — ela não consegue distinguir um número romano de uma palavra comum, já que para uma expressão regular são os mesmos caracteres.
Como é calculado
O texto é comparado caractere por caractere com a expressão regular [a-zA-Z], que lista as 26 letras do alfabeto inglês em minúscula e maiúscula. Cada correspondência soma um ao contador.
A proporção de letras latinas é o número de letras latinas dividido pelo comprimento total do texto (todos os caracteres, incluindo espaços e pontuação), multiplicado por 100.
«Outros caracteres» é tudo o que não correspondeu ao padrão latino: dígitos, pontuação, espaços, cirílico, caracteres de outros alfabetos e emojis. É calculado como o comprimento total menos o número de letras latinas.
A contagem opera sobre os code points da string JavaScript, então letras acentuadas fora da faixa ASCII básica (por exemplo, é como um único code point composto) não correspondem a [a-zA-Z] e acabam em «outros caracteres».
Perguntas e respostas
Letras acentuadas como é ou ü são contadas?
Não, o padrão [a-zA-Z] cobre apenas o latino básico ASCII. Letras acentuadas ficam excluídas e são contadas como «outros caracteres».
A caixa da letra importa?
Não, maiúsculas e minúsculas são contadas igualmente — «A» e «a» contribuem da mesma forma para o total.
Serve para contar o latino em texto misto russo-inglês?
Sim, esse é um dos principais usos — a ferramenta separa as letras latinas do cirílico, dos dígitos e da pontuação, útil para estimar a proporção de inserções em inglês.
O que cai em «outros caracteres»?
Tudo o que não for uma letra do alfabeto latino: dígitos, espaços, pontuação, letras cirílicas, letras acentuadas e emojis.
Meu texto é enviado para algum lugar?
Não. Toda a contagem roda no seu navegador; o texto nunca é transmitido para lugar nenhum.