Qué incluye este recuento de tokens
Elige la codificación exacta que necesita tu aplicación. El tokenizador divide el texto en fragmentos de bytes UTF-8 y los combina según el vocabulario seleccionado. Los espacios en blanco, las mayúsculas y la puntuación pueden cambiar los tokens aunque las palabras parezcan similares.
El recuento solo incluye el texto pegado. Excluye los roles del chat, las estructuras añadidas por el sistema, las herramientas, las imágenes, el audio y los demás elementos adicionales de la solicitud. Los nombres de las codificaciones se muestran directamente para evitar que un cambio de nombre de un modelo seleccione un vocabulario incorrecto sin avisar.
Abre los detalles de los tokens para consultar sus límites e identificadores. Los identificadores exportados reconstruyen los bytes UTF-8 del texto; la herramienta comprueba que coincidan antes de permitir la exportación. Las cadenas que parecen tokens especiales se cuentan como texto normal.
Ejemplo
«hello world» tiene 2 tokens en ambas codificaciones, pero sus identificadores son distintos: cl100k_base produce [15339, 1917] y o200k_base produce [24912, 2375].
Antes de usar el resultado
Este recuento no refleja el uso facturado de la API ni garantiza que el texto quepa en una ventana de contexto. Solo admite las dos codificaciones base indicadas. Los tokens pueden dividir un carácter Unicode; un fragmento individual de la vista previa puede mostrar un símbolo de sustitución aunque los bytes combinados sean exactos. Los sustitutos UTF-16 aislados y no válidos se normalizan al carácter de sustitución.
Actualizado
Citar esta página
ToolOctopus. “Contador de tokens.” Actualizado 7 de octubre de 2026. https://tooloctopus.com/es/contador-de-tokens.
Añade la fecha de consulta si tus instrucciones lo requieren.
Las citas se formatean con citeproc-js, de Frank Bennett, y estilos de Citation Style Language. Licencia y código fuente.