Pegue texto para estimar Explain how HTTP caching works to a junior developer. Cover ETags, Cache-Control, and the Vary header in under 200 words.
Qué hace
El estimador de tokens te da un recuento de tokens rápido y aproximado para cualquier texto, código o JSON antes de enviarlo a un LLM. En lugar de ejecutar un tokenizador real, clasifica cada línea como prosa, código, JSON o texto CJK y divide por la tasa típica de caracteres por token de ese tipo de contenido (4 / 3.5 / 3 / 1.5); después informa de una estimación puntual con una banda de ±15% - porque los tokenizadores BPE reales varían según el vocabulario y la mezcla de idiomas. También puede añadir la sobrecarga del enmarcado de chat (~5 tokens por mensaje) para los marcadores de rol y los delimitadores. Todo se ejecuta 100% en el cliente: nada de lo que pegues se envía nunca a un servidor, así que es seguro para prompts sensibles.
Cómo usarlo
- Pega tu texto o código en la caja Texto o código (o pulsa Ejemplo para cargar un prompt de demostración).
- Deja el Tipo de contenido en Auto para detectar cada línea, o fuerza Prosa / Código / JSON / CJK para aplicar una sola tasa a toda la entrada.
- Fija Mensajes de chat en el número de mensajes de tu conversación - cada uno añade 5 tokens de enmarcado al total.
- Lee el titular Tokens estimados, el rango bajo-alto, los caracteres / palabras / líneas y el tipo de contenido resuelto.
- Copiar tokens para llevarte el número, o Copiar enlace para compartir para enviar la entrada y los ajustes exactos a un compañero.
Ejemplos
Prosa simple
Entrada: Hello world → 3 tokens (≈ 3–3, type: prose)
Código
Entrada: const x = 1; → 3 tokens (type: code)
El JSON recibe la tasa densa automáticamente
Entrada: {"a": 1, "b": 2} → 5 tokens (type: json — the whole document parses as JSON, so every line uses the 3 chars/token rate)
Un bloque más largo con banda visible
Entrada: 100 × a → 25 tokens (≈ 21–29)
Buen saber
- Son estimaciones, no recuentos exactos: cada resultado lleva una banda de ±15% y no se ejecuta ningún tokenizador. Trata el número como una ayuda para presupuestar, no como una factura - los proveedores de modelos cuentan tokens con vocabularios específicos de cada modelo.
- El modo Auto detecta documentos JSON como un todo: si tu entrada se parsea como JSON válido, cada línea usa la tasa JSON. Fuerza un tipo de contenido para anularlo.
- El texto CJK es caro: el chino, el japonés y el coreano empaquetan aproximadamente un token por 1.5 caracteres - la misma “página” de texto puede costar 2-3× más tokens que el inglés.
- Compartible: tu entrada y tus opciones quedan codificadas en la URL (
?t=...&type=...&msg=...), así que un enlace reproduce la estimación exacta. - Privado: toda la estimación ocurre en local - segura para secretos y credenciales.
- Herramientas relacionadas: Word Counter, Secure Token Generator, JSON Formatter.