Tempel teks atau unggah berkas .txt dan dapatkan tabel kata dengan jumlah, persentase, dan posisi, plus grafik dan ekspor CSV.
Teks dan berkas di-tokenisasi di halaman ini; tidak ada yang diunggah, disimpan, atau dikirim lewat jaringan sama sekali.
Setiap kali Anda mengetik, mengubah kontrol, atau memuat berkas, alat ini meng-tokenisasi ulang teks dengan ekspresi reguler yang melek Unicode, menerapkan saringan Anda (panjang minimum, penanganan huruf besar, daftar stopword), menghitung token yang lolos dalam sebuah peta, dan mencatat posisi kemunculan pertama tiap kata dalam aliran. Hasilnya mengalir ke empat tempat sekaligus: kartu statistik ringkasan, grafik batang 15 teratas pada canvas, tabel peringkat (dibatasi 50 baris pertama agar terbaca), dan ekspor CSV/papan klip yang selalu mencerminkan saringan saat ini.
Tidak — penganalisisnya ketat satu kata. Setiap deretan huruf (dengan satu apostrof internal opsional, jadi "don't" utuh) adalah satu token, dan frasa multi-kata tidak pernah dirakit. Tinjauan bigram atau n-gram butuh statistik berbeda, jadi halaman ini berpegang pada satu hal yang bisa dihitung tepat oleh penghitung sederhana.
Tidak. Tokenizer hanya menyimpan huruf (alfabet apa pun) plus apostrof sisipan yang opsional, jadi "42", "$5.50", dan "2026" dilewati seluruhnya — kalau tidak, teks keuangan atau penuh tanggal akan dipenuhi baris sampah. Jika Anda perlu token numerik dihitung, ini alat yang salah untuk pekerjaan itu.
Karena dalam teks bahasa Inggris apa pun kata tersering adalah kata fungsional — the, and, of, to. Tepatnya itulah yang disaring filter stopword (aktif secara bawaan): daftar bawaan sekitar 200 kata fungsional Inggris. Saat dimatikan Anda melihat distribusi mentah apa adanya; saat aktif, kata-kata pembawa topik. Daftarnya khusus Inggris — matikan untuk bahasa lain.
Bisa. Tokenizer-nya melek Unicode (\p{L} mencakup aksen Latin, Yunani, Sirilik, Arab, Ibrani, dan skrip CJK dipecah per kelompok karena tidak berspasi). Yang khusus Inggris hanyalah daftar stopword — untuk bahasa lain, matikan penyaringnya dan nilai sendiri kata-kata teratasnya.
Tidak. Teks tempel dan berkas .txt dibaca serta di-tokenisasi sepenuhnya oleh JavaScript di halaman ini — berkas tidak pernah meninggalkan disk Anda dan tidak ada permintaan jaringan apa pun. Unduhan CSV dan salin ke papan klip juga dihasilkan secara lokal.
Jika Anda baru saja memakai Penghitung Frekuensi Kata, langkah berikutnya yang wajar adalah Kalkulator kebacaan, Pembuat Data JSON Mock, Penghitung kata & karakter, atau telusuri semua alat Alat harian.