acento.io
Ferramenta dev

Token Counter

Estime tokens para GPT-4o, Claude, Gemini e Llama — 100% no navegador, sem enviar nada a nenhum servidor.

Por Carlos Suárez , Engenheiro de sistemas
Última atualização:

O que este Token Counter faz

Esta versão em português do Token Counter estima quantos tokens um texto vai consumir nos principais modelos de linguagem — GPT-4o, GPT-3.5, Claude, Gemini e Llama — e projeta o custo aproximado às tarifas típicas de API. Ao contrário de contadores que enviam seu texto para um servidor externo, aqui tudo roda localmente: 100% no navegador — seus dados nunca saem do seu computador. Sem uploads, sem rastreamento, sem logs em servidor. A tokenização varia bastante entre famílias de modelos: um mesmo parágrafo pode gerar contagens diferentes no GPT-4o e no Claude, o que afeta diretamente o custo de chamadas em produção. O Dicionário Houaiss registra cerca de 228.500 entradas do português, e essa riqueza lexical — com palavras compostas, acentuações do Acordo Ortográfico de 1990 e contrações — influencia como os tokenizadores dividem o texto. Ver os números lado a lado, em vez de ter de escolher um modelo antes de contar, é o que diferencia esta ferramenta.

Recursos

  • Comparação simultânea de 5 modelos. Exibe contagens de tokens para GPT-4o, GPT-3.5, Claude, Gemini e Llama em uma única análise, sem precisar alternar entre ferramentas.
  • Projeção de custo por modelo. Calcula o custo estimado de cada chamada de API com base nas tarifas públicas atuais de cada provedor, útil para orçar aplicações em produção.
  • Estatísticas completas do texto. Além dos tokens, mostra contagem de caracteres, palavras e frases — métricas úteis para redatores, engenheiros de prompt e revisores técnicos.
  • Privacidade total, sem API key. O processamento ocorre inteiramente no seu navegador. Nenhum texto é enviado a servidores externos e nenhuma chave de API é necessária para usar a ferramenta.
  • Contador OpenAI integrado. Simula a lógica do tokenizador tiktoken para os modelos OpenAI, incluindo GPT-4o e GPT-3.5, entregando estimativas próximas das contagens reais cobradas na API.
  • Interface limpa para fluxos de trabalho rápidos. Cole, calcule e copie os resultados em segundos. Ideal para quem itera sobre prompts com frequência ou precisa validar tamanho de contexto antes de uma chamada.

Como usar o Token Counter

Cole qualquer texto na área de entrada e clique em Calcular. Os resultados aparecem imediatamente para todos os modelos.

  1. Cole o texto. Insira o conteúdo que você quer analisar — um prompt, um trecho de código, uma instrução de sistema ou qualquer bloco de texto.
  2. Clique em Calcular. O contador processa o texto localmente e exibe as estimativas de tokens por modelo, além de caracteres, palavras e frases.
  3. Compare os modelos. Veja as diferenças de tokenização entre GPT-4o, Claude e Gemini lado a lado. Um texto com muitas palavras compostas, como em prompts técnicos em português, pode ter variação de 10–20% entre modelos.
  4. Analise o custo projetado. Use a projeção de custo para decidir qual modelo equilibra melhor qualidade e preço para o seu caso de uso específico.
  5. Copie os resultados. Clique em Copiar para levar os dados para uma planilha, um documento de arquitetura ou um ticket de engenharia.

Casos de uso comuns

  • Engenharia de prompt. Ajuste prompts de sistema e exemplos few-shot para caber dentro do limite de contexto de cada modelo sem estouro de janela — especialmente crítico em fluxos de produção com GPT-4o.
  • Orçamento de API em startups. Times baseados em Salvador ou em qualquer lugar que faturam em reais precisam estimar custo em dólar com precisão. Compare GPT e Claude antes de escolher o modelo para o seu produto.
  • Auditoria de documentos longos. Verifique se um PDF convertido em texto, um contrato ou uma base de conhecimento cabe no contexto disponível antes de passar para um pipeline RAG.
  • Desenvolvimento de chatbots e assistentes. Ao montar histórico de conversas para enviar à API, conte tokens do histórico acumulado para evitar erros de contexto excedido em tempo de execução. Se precisar gerar identificadores únicos por sessão, o [gerador UUID](/pt/uuid-generator/) é um complemento natural.
  • Redação técnica e documentação. Escritores que produzem documentação extensa — à escala de um Ulysses, com centenas de milhares de palavras — podem monitorar o tamanho de seções para otimizar chamadas de sumarização em lote.

Perguntas frequentes

Meu texto é enviado para algum servidor quando uso esta ferramenta?

Não. Todo o processamento ocorre no seu navegador via JavaScript. O texto que você cola nunca sai do seu dispositivo — não há chamada de rede, sem log em servidor, sem armazenamento. Isso vale também para textos confidenciais como prompts proprietários ou dados de clientes.

Por que a contagem de tokens difere entre GPT-4o e Claude para o mesmo texto?

Cada família de modelos usa um vocabulário de subpalavras diferente. O GPT-4o usa tiktoken com vocabulário cl100k_base, enquanto Claude usa um tokenizador próprio da Anthropic. Palavras compostas, acentos e pontuação do português podem ser segmentados de forma distinta, gerando contagens que variam 5–20% para o mesmo parágrafo.

Como faço para saber se meu prompt cabe na janela de contexto de um modelo?

Use o Token Counter para obter a estimativa total do seu prompt (instrução de sistema + histórico + entrada do usuário). Compare com o limite do modelo: GPT-4o suporta até 128k tokens, Claude 3.5 Sonnet até 200k. Se o total ultrapassar o limite, refatore ou comprima o conteúdo antes de enviar.

A projeção de custo é exata?

É uma estimativa baseada nas tarifas públicas de entrada (input tokens) de cada provedor. O custo real pode variar conforme tier de uso, tokens de saída, chamadas em cache ou descontos por volume. Use como referência de ordem de grandeza, não como fatura definitiva.

Existe alguma relação entre contagem de tokens e contagem de palavras?

Aproximadamente, 1 token corresponde a 0,75 palavras em inglês — cerca de 100 tokens para 75 palavras. Em português, com palavras em média um pouco mais longas, a proporção pode ser ligeiramente diferente. Esta ferramenta mostra tanto tokens quanto palavras, permitindo calibrar essa relação para o seu conteúdo específico. Se você também trabalha com codificação de texto, o [codificador e decodificador Base64](/pt/base64/) pode ser útil em pipelines de pré-processamento.

Preciso de uma API key da OpenAI ou da Anthropic para usar o contador?

Não. A ferramenta usa algoritmos de estimativa locais inspirados nos tokenizadores públicos, sem se conectar às APIs dos provedores. Nenhuma chave de autenticação é necessária ou solicitada em nenhum momento.