Cole texto para estimar Explain how HTTP caching works to a junior developer. Cover ETags, Cache-Control, and the Vary header in under 200 words.
O que faz
O Estimador de Tokens dá a você uma contagem de tokens rápida e aproximada para qualquer texto, código ou JSON antes de você enviá-lo a um LLM. Em vez de rodar um tokenizador de verdade, ele classifica cada linha como prosa, código, JSON ou texto CJK e divide pela taxa típica de caracteres por token daquele tipo de conteúdo (4 / 3.5 / 3 / 1.5), então relata uma estimativa pontual com uma faixa de ±15% - porque tokenizadores BPE reais variam por vocabulário e mistura de idiomas. Ele também pode adicionar o overhead de enquadramento de chat (~5 tokens por mensagem) para marcadores de papel e delimitadores. Tudo roda 100% no cliente: nada do que você cola é enviado a um servidor, então é seguro para prompts sensíveis.
Como usar
- Cole seu texto ou código na caixa Texto ou código (ou clique em Exemplo para carregar um prompt de demonstração).
- Deixe o Tipo de conteúdo em Auto para detectar cada linha, ou force Prose / Code / JSON / CJK para aplicar uma taxa única a toda a entrada.
- Defina Mensagens de chat como o número de mensagens da sua conversa - cada uma adiciona 5 tokens de enquadramento ao total.
- Leia o número principal Tokens estimados, o intervalo mínimo-máximo, caracteres / palavras / linhas e o tipo de conteúdo resolvido.
- Use Copiar tokens para pegar o número, ou Copiar link de compartilhamento para enviar a entrada e as configurações exatas a um colega.
Exemplos
Prosa simples
Entrada: Hello world → 3 tokens (≈ 3–3, type: prose)
Código
Entrada: const x = 1; → 3 tokens (type: code)
JSON ganha a taxa densa automaticamente
Entrada: {"a": 1, "b": 2} → 5 tokens (type: json - o documento inteiro é parseado como JSON, então cada linha usa a taxa de 3 caracteres por token)
Um bloco maior com uma faixa visível
Entrada: 100 × a → 25 tokens (≈ 21-29)
Bom saber
- Estas são estimativas, não contagens exatas: todo resultado carrega uma faixa de ±15% e nenhum tokenizador roda de fato. Trate o número como uma ajuda de orçamento, não como uma fatura - provedores de modelo contam tokens com vocabulários específicos de cada modelo.
- O modo Auto detecta documentos JSON como um todo: se sua entrada é parseada como JSON válido, cada linha usa a taxa JSON. Force um tipo de conteúdo para sobrescrever isso.
- Texto CJK é caro: chinês, japonês e coreano empacotam cerca de um token por 1.5 caracteres - a mesma “página” de texto pode custar 2-3× mais tokens que o inglês.
- Compartilhável: sua entrada e suas opções são codificadas na URL (
?t=...&type=...&msg=...), então um link reproduz a estimativa exata. - Privado: toda a estimativa acontece localmente - seguro para segredos e credenciais.
- Ferramentas relacionadas: Word Counter, Secure Token Generator, JSON Formatter.