Cole um texto ou envie um .txt e receba uma tabela com contagens, percentual e primeira posição, além de gráfico e exportação CSV.
Textos e arquivos são tokenizados nesta página; nada é enviado, guardado ou transmitido pela rede em nenhum momento.
Sempre que você digita, muda um controle ou carrega um arquivo, a ferramenta re-tokeniza o texto com uma expressão regular consciente de Unicode, aplica seus filtros (comprimento mínimo, tratamento de maiúsculas, lista de stopwords), conta os tokens sobreviventes num mapa e registra a primeira posição de cada palavra no fluxo. Os resultados alimentam quatro lugares de uma vez: os cartões de resumo, o gráfico de barras do top-15 em canvas, a tabela ranqueada (limitada às primeiras 50 linhas por legibilidade) e as exportações CSV/área de transferência, que sempre refletem os filtros atuais.
Não — o analisador é estritamente de palavra única. Cada sequência de letras (com um apóstrofo interno opcional, então "don't" fica inteiro) é um token, e frases de várias palavras nunca são montadas. Uma visão de bigramas ou n-gramas exige outras estatísticas, então esta página fica no que um contador simples faz com exatidão.
Não. O tokenizador mantém apenas letras (qualquer alfabeto) mais um apóstrofo embutido opcional, então "42", "$5.50" e "2026" são ignorados por completo — caso contrário inundariam de lixo textos financeiros ou cheios de datas. Se você precisa contar tokens numéricos, esta é a ferramenta errada para o serviço.
Porque em qualquer texto em inglês as palavras mais frequentes são funcionais — the, and, of, to. É exatamente isso que o filtro de stopwords (ligado por padrão) remove: uma lista embutida de cerca de 200 palavras funcionais do inglês. Com ele desligado você vê a distribuição crua real; ligado, vê as palavras que carregam o assunto. A lista é só de inglês — desligue para outros idiomas.
Sim. O tokenizador é consciente de Unicode (\p{L} cobre acentos latinos, grego, cirílico, árabe, hebraico, e escritas CJK são divididas grupo a grupo por não terem espaços). O único próprio do inglês é a lista de stopwords — para outros idiomas, desligue o filtro e julgue você mesmo as palavras do topo.
Não. Textos colados e arquivos .txt enviados são lidos e tokenizados inteiramente por JavaScript nesta página — o arquivo nunca sai do seu disco e não há requisição de rede de tipo algum. O download CSV e a cópia para a área de transferência também são gerados localmente.
Se você acabou de usar Contador de frequência de palavras, os próximos passos naturais são Calculadora de legibilidade, Gerador de dados JSON fictícios, Contador de palavras e caracteres, ou explore todas as ferramentas de Ferramentas diárias.