Penghitung token

Hitung token teks biasa dengan o200k_base atau cl100k_base. Lihat batas token, salin ID, dan unduh JSON berisi semua token.

Di perangkat Anda · Tanpa akun

Penghitung token memproses masukan Anda di browser ini. Masukan dan hasil tidak disertakan dalam analitik. Daftar alat terbaru menyimpan nama alat, jumlah kunjungan, dan waktu kunjungan terakhir. Daftar alat tersimpan hanya menyimpan namanya. Penyimpanan draf bersifat opsional dan tetap berada di perangkat ini; hapus teks tersimpan melalui kontrol draf. Memuat teks dari URL bersifat opsional dan menghubungi server tersebut; server dapat melihat URL itu dan alamat IP Anda. Tindakan opsional “Gunakan di” menyimpan data yang akan diteruskan dalam tab ini. Alat berikutnya menghapus data itu saat dibuka dan mengabaikannya jika sudah lebih dari satu menit.

Salin tautan menyertakan masukan yang Anda pilih untuk dibagikan dalam alamat tautan. Siapa pun yang memiliki tautan itu dapat membuka kembali masukan tersebut. File dan hasil yang dihasilkan tidak disertakan. Alat kata sandi dan kunci hanya membagikan pengaturan.

Menghitung teks biasa dengan encoding yang dipilih. Peran dalam chat, alat, gambar, dan struktur pembungkus pesan menambah token di luar hitungan ini.

Jumlah token

Lihat batas dan ID token

␠ menandai spasi, ↵ pergantian baris, dan ⇥ tab. Batas token dapat membelah karakter Unicode; � dalam potongan tidak mengubah byte aslinya. Arahkan kursor ke potongan untuk melihat ID dan byte-nya.

Lainnya
Pintasan keyboard

Tentang tautan dan reset

Tautan memuat input dan pengaturan Anda. Siapa pun yang memiliki tautan dapat melihatnya, jadi jangan sertakan teks pribadi. File dan hasil yang dibuat tidak disertakan; pengacakan akan dijalankan ulang.

Reset memuat ulang alat dengan nilai awalnya serta melepaskan file yang terbuka dan kontrol perangkat. Draf tersimpan tetap ada di perangkat ini sampai Anda menghapusnya.

Apa saja yang masuk dalam hitungan token ini

Pilih encoding yang tepat sesuai kebutuhan aplikasi Anda. Tokenizer membagi teks menjadi potongan byte UTF-8 lalu menggabungkannya menggunakan kosakata yang dipilih. Spasi, penggunaan huruf kapital, dan tanda baca dapat mengubah token meskipun kata-katanya terlihat serupa.

Hitungan hanya mencakup teks yang ditempel. Peran dalam chat, pembungkus sistem, alat, gambar, audio, dan komponen tambahan permintaan lainnya tidak dihitung. Nama encoding ditampilkan langsung agar perubahan nama model tidak menyebabkan kosakata yang salah dipilih tanpa diketahui.

Buka detail token untuk memeriksa batas dan ID-nya. ID token yang diekspor dapat menyusun kembali byte UTF-8 teks; alat ini memeriksa kecocokannya sebelum mengaktifkan ekspor. String yang menyerupai token khusus dihitung sebagai teks biasa.

Berikutnya: Penghitung karakter

Contoh

“hello world” terdiri dari 2 token pada kedua encoding, tetapi ID-nya berbeda: cl100k_base menghasilkan [15339, 1917] dan o200k_base menghasilkan [24912, 2375].

Berikutnya: Penghitung kata

Sebelum menggunakan hasil

Hitungan ini bukan jumlah penggunaan API yang ditagihkan atau jaminan batas konteks. Alat ini hanya mendukung dua encoding dasar yang disebutkan. Token dapat membelah satu karakter Unicode; pratinjau satu potongan bisa menampilkan simbol pengganti meskipun gabungan byte-nya tepat. Surrogate UTF-16 yang tidak valid dan tidak berpasangan dinormalisasi menjadi karakter pengganti.

Diperbarui

Kutip halaman ini

ToolOctopus. “Penghitung token.” Diperbarui 7 Oktober 2026. https://tooloctopus.com/id/penghitung-token.

Tambahkan tanggal akses jika pedoman yang Anda ikuti mewajibkannya.

Format sitasi menggunakan citeproc-js buatan Frank Bennett dan gaya Citation Style Language. Lisensi dan kode sumber.

Cari alat

Type a task, a unit pair, a sum or a time zone. ↓ to choose, Enter to open.