Pega un texto o sube un .txt y obtén una tabla de palabras con conteos, porcentaje y primera posición, más gráfico y exportación CSV.
El texto y los archivos se tokenizan en esta página; nada se sube, se guarda ni se envía por la red en ningún momento.
Cada vez que escribes, cambias un control o cargas un archivo, la herramienta re-tokeniza el texto con una expresión regular consciente de Unicode, aplica tus filtros (longitud mínima, manejo de mayúsculas, lista de stopwords), cuenta los tokens supervivientes en un mapa y registra la primera posición de cada palabra en el flujo. Los resultados alimentan cuatro sitios a la vez: las tarjetas de resumen, el gráfico de barras del top-15 en canvas, la tabla ordenada (limitada a las primeras 50 filas por legibilidad) y las exportaciones CSV/portapapeles, que siempre reflejan los filtros actuales.
No — el analizador es estrictamente de una palabra. Cada secuencia de letras (con un apóstrofo interno opcional, así "don't" queda entero) es un token, y nunca se ensamblan frases de varias palabras. Una vista de bigramas o n-gramas necesita otras estadísticas, así que esta página se limita a lo que un contador simple puede hacer con exactitud.
No. El tokenizador conserva solo letras (de cualquier alfabeto) más un apóstrofo opcional incrustado, así que "42", "$5.50" y "2026" se descartan por completo — de otro modo inundarían de basura los textos financieros o llenos de fechas. Si necesitas contar tokens numéricos, esta no es la herramienta adecuada.
Porque en cualquier texto en inglés las palabras más frecuentes son funcionales — the, and, of, to. Eso es justo lo que quita el filtro de stopwords (activo por defecto): una lista integrada de unas 200 palabras funcionales del inglés. Apagado ves la distribución cruda real; encendido ves las palabras que cargan el tema. La lista es solo de inglés, así que desactívalo para otros idiomas.
Sí. El tokenizador es consciente de Unicode (\p{L} cubre acentos latinos, griego, cirílico, árabe, hebreo, y las escrituras CJK se dividen grupo a grupo porque no llevan espacios). Lo único propio del inglés es la lista de stopwords — para otros idiomas, apaga el filtro y juzga tú mismo las palabras más frecuentes.
No. El texto pegado y los archivos .txt se leen y tokenizan por completo con JavaScript en esta página — el archivo nunca sale de tu disco y no hay petición de red de ningún tipo. La descarga CSV y la copia al portapapeles también se generan localmente.
Si acabas de usar Contador de frecuencia de palabras, los siguientes pasos naturales son Calculadora de legibilidad, Generador de datos JSON de prueba, Contador de palabras y caracteres, o explora todas las herramientas de Herramientas diarias.