Texto y datos
Contar tokens
Pega un prompt o un documento y mira el recuento exacto de tokens, del tokenizador de verdad y no de la regla «caracteres entre cuatro». La tabla de abajo dice si cabe. Tu texto no se sube.
Guardar y continuar en el escritorio
Descarga o copia tu resultado aquí primero. Continúa en el escritorio para guardar en Archivos o usar más funciones.
- Notas simples con negrita y listas — guardadas localmente
- Guarda en Archivos cuando continúes en el escritorio
- Todas las herramientas en un lugar, sin pestañas nuevas
Después de descargar — continúa en el escritorio para Archivos o la app completa.
Qué puede hacer Contar tokens
Exacto donde se puede, marcado donde no
OpenAI publica sus tokenizadores, así que el recuento para GPT-5, GPT-4.1, GPT-4o y los antiguos GPT-4 y 3.5 es exacto: el mismo vocabulario de pares de bytes que usa la API, ejecutándose aquí. Nadie más publica el suyo. Por eso las filas de Claude, Gemini y Llama llevan ≈ y se cuentan con el vocabulario de OpenAI en lugar del propio, lo que en prosa corriente queda dentro de un pequeño margen. La mayoría de los contadores imprimen esas cifras sin marca alguna, y ahí está la diferencia entre una estimación y una afirmación.
Por qué «caracteres entre cuatro» te falla
Esa regla está calibrada sobre prosa en inglés y sobre nada más. Un tokenizador trabaja con pares de bytes: una palabra inglesa común es un token, una rara son tres, y el ruso, el griego, el hebreo o el tailandés cuestan a menudo un token por carácter o peor. El mismo párrafo puede costar el doble en un idioma y la mitad en otro. El código, el JSON y las URLs largas rompen la regla en la otra dirección. Y si estás al borde del límite, la diferencia entre la regla y el número real es justo lo que decide si la llamada pasa.
El vocabulario se descarga una vez y nada más sale de aquí
El tokenizador ocupa alrededor de un megabyte y se descarga la primera vez que escribes, luego queda en caché: por eso los recuentos de caracteres y palabras aparecen al instante mientras llega, y la siguiente visita es inmediata. Tu texto no forma parte de eso: se tokeniza aquí, en esta pestaña, y no se envía a ningún sitio. Esa es toda la razón de contar en local en vez de pegar un prompt confidencial en el servidor de otro para que lo mida.
Apps relacionadas
Texto y datos
Contar caracteres
Pega tu texto y mira los caracteres al instante, con y sin espacios.
Texto y datos
Contar palabras
Pega tu texto y cuenta palabras, caracteres y tiempo de lectura…
Texto y datos
PDF a Markdown
Suelta un PDF y obtén Markdown con títulos, párrafos y listas, no una…
Texto y datos
Eliminar caracteres ocultos
Pega el texto y la parte invisible se vuelve visible: espacios de…
Texto y datos
Escribir una nota
Escribe texto, formatea con negrita y listas — descarga o copia, luego…
Preguntas
¿Se sube mi texto a algún sitio?
No. El tokenizador se ejecuta en tu navegador, en este dispositivo. El texto nunca se envía a un servidor y nosotros no lo vemos.
¿Qué tokenizador usa?
o200k_base para GPT-5, GPT-4.1 y GPT-4o, y cl100k_base para GPT-4 Turbo, GPT-3.5 y los embeddings de OpenAI: los mismos vocabularios que usan esos modelos.
¿Son exactas las cifras de Claude y Gemini?
No, y por eso llevan ≈. Ninguno de los dos publica su tokenizador, así que esas filas se cuentan con el de OpenAI como sustituto. En prosa corriente el desvío es de pocos puntos porcentuales; considera arriesgado un texto que quede justo en el límite.
¿Por qué la primera vez tarda un momento?
Porque el vocabulario ocupa cerca de un megabyte y se descarga una sola vez, y luego lo guarda tu navegador. Los caracteres y las palabras se cuentan al momento, sin descargar nada.
¿Cuenta tokens de código y JSON?
Sí, es el mismo tokenizador. Y el código es precisamente donde la regla de «caracteres entre cuatro» más se aleja.