O que entra na contagem de tokens
Escolha a codificação exata exigida pela sua aplicação. O tokenizador divide o texto em trechos de bytes UTF-8 e os combina usando o vocabulário selecionado. Espaços em branco, maiúsculas, minúsculas e pontuação podem mudar os tokens mesmo quando as palavras parecem semelhantes.
A contagem inclui apenas o texto colado. Não inclui papéis de mensagens no chat, estruturas de sistema, ferramentas, imagens, áudio nem outros elementos adicionais da requisição. Os nomes das codificações aparecem diretamente para evitar que uma mudança no nome de um modelo selecione o vocabulário errado sem aviso.
Abra os detalhes dos tokens para conferir seus limites e IDs. Os IDs exportados reconstituem os bytes UTF-8 do texto; a ferramenta verifica essa correspondência antes de liberar a exportação. Sequências que parecem tokens especiais são contadas como texto comum.
Exemplo
“hello world” tem 2 tokens nas duas codificações, mas os IDs são diferentes: cl100k_base gera [15339, 1917] e o200k_base gera [24912, 2375].
Antes de usar o resultado
Esta contagem não representa o uso faturado da API nem garante que o texto caiba na janela de contexto. Só são aceitas as duas codificações base indicadas. Os tokens podem dividir um caractere Unicode; um trecho da prévia pode exibir um símbolo de substituição mesmo quando os bytes combinados são exatos. Substitutos UTF-16 isolados e inválidos são normalizados para o caractere de substituição.
Atualizado
Como citar esta página
ToolOctopus. “Contador de tokens.” Atualizado 7 de outubro de 2026. https://tooloctopus.com/pt/contador-de-tokens.
Inclua a data de acesso se as suas instruções exigirem.
As citações são formatadas com citeproc-js, de Frank Bennett, e estilos da Citation Style Language. Licença e código-fonte.