Tokens tellen

Tel tokens in platte tekst met o200k_base of cl100k_base. Bekijk tokengrenzen, kopieer ID's en download JSON met alle tokens.

Op je apparaat · Geen account

Tokens tellen verwerkt je invoer in deze browser. Invoer en resultaten worden niet opgenomen in de statistieken. Bij recent gebruikte tools worden toolnamen, aantallen bezoeken en tijdstippen van het laatste bezoek opgeslagen. Bij opgeslagen tools worden alleen de namen bewaard. Concepten opslaan is optioneel en gebeurt op dit apparaat; verwijder opgeslagen tekst met de knoppen voor het concept. Tekst laden via een URL is optioneel en maakt verbinding met die server; de server ziet de URL en je IP-adres. De optionele actie “Gebruiken in” bewaart gegevens voor overdracht in dit tabblad. De volgende tool verwijdert die gegevens bij het openen en negeert ze als er meer dan een minuut is verstreken.

‘Link kopiëren’ neemt de invoer die je wilt delen op in het webadres. Iedereen met die link kan de invoer opnieuw openen. Bestanden en gegenereerde resultaten worden niet opgenomen. Tools voor wachtwoorden en sleutels delen alleen instellingen.

Telt tokens in gewone tekst met de gekozen codering. Chatrollen, tools, afbeeldingen en de structuur rond berichten voegen tokens toe die buiten deze telling vallen.

Aantal tokens

Bekijk tokengrenzen en ID's

␠ is een spatie, ↵ een regeleinde en ⇥ een tab. Een token kan een Unicode-teken splitsen; � in een tekstdeel verandert de oorspronkelijke bytes niet. Beweeg de muis over een tekstdeel om het ID en de bytes te zien.

Meer
Sneltoetsen

Over links en resetten

Links bevatten je invoer en instellingen. Iedereen met de link kan die zien, dus laat privétekst weg. Bestanden en gegenereerde resultaten worden niet opgenomen; willekeurige trekkingen worden opnieuw uitgevoerd.

Resetten laadt de tool opnieuw met de beginwaarden, sluit geopende bestanden en geeft de bediening van apparaten vrij. Opgeslagen concepten blijven op dit apparaat staan totdat je ze verwijdert.

Wat telt deze tokenteller mee?

Kies precies de encodering die je toepassing nodig heeft. De tokenizer splitst je tekst in stukken UTF-8-bytes en voegt die samen volgens de gekozen woordenschat. Witruimte, hoofdletters en leestekens kunnen de tokens veranderen, ook als de woorden op elkaar lijken.

De telling omvat alleen de geplakte tekst. Chatrollen, systeemomhulsels, tools, afbeeldingen, audio en andere extra onderdelen van het verzoek tellen niet mee. De namen van de encoderingen staan er rechtstreeks bij, zodat een veranderende modelnaam niet ongemerkt de verkeerde woordenschat kiest.

Open de tokendetails om grenzen en ID's te bekijken. De geëxporteerde token-ID's reconstrueren de UTF-8-bytes van de tekst; de tool controleert of die overeenkomen voordat exporteren mogelijk wordt. Tekenreeksen die op speciale tokens lijken, tellen als gewone tekst.

Volgende: Tekens tellen

Voorbeeld

“hello world” bestaat in beide encoderingen uit 2 tokens, maar de ID's verschillen: cl100k_base geeft [15339, 1917] en o200k_base geeft [24912, 2375].

Volgende: Woorden tellen

Voordat je het resultaat gebruikt

Deze telling geeft niet het gefactureerde API-gebruik weer en garandeert niet dat de tekst binnen het contextvenster past. Alleen de twee genoemde basisencoderingen worden ondersteund. Tokens kunnen een Unicode-teken splitsen; een afzonderlijk stukje in het voorbeeld kan een vervangingssymbool tonen, ook als de gecombineerde bytes exact kloppen. Losse, ongeldige UTF-16-surrogaten worden genormaliseerd naar het vervangingsteken.

Bijgewerkt

Deze pagina citeren

ToolOctopus. “Tokens tellen.” Bijgewerkt 7 oktober 2026. https://tooloctopus.com/nl/tokens-tellen.

Voeg een raadpleegdatum toe als je instructies dat vereisen.

Bronvermeldingen worden opgemaakt met citeproc-js van Frank Bennett en stijlen uit Citation Style Language. Licentie en broncode.

Zoek een tool

Type a task, a unit pair, a sum or a time zone. ↓ to choose, Enter to open.