acento.io
Strumento per sviluppatori

Token Counter

Stima i token del tuo testo per 5 famiglie di modelli LLM in un unico passaggio — senza inviare nulla a nessun server.

By Carlos Suárez , Systems engineer
Last updated:

Cosa fa questo Token Counter

Questo token counter analizza il tuo testo e restituisce stime di token per GPT-4o, GPT-3.5, Claude, Gemini e Llama — tutto in un solo passaggio, senza doverti fermare a scegliere il modello prima. Ottieni anche il conteggio di caratteri, parole e frasi, più una proiezione del costo API ai prezzi tipici per milione di token. La versione italiana del tool è pensata per chi lavora con prompt in italiano: tieni presente che il vocabolario dello Zingarelli 2024 conta oltre 144.000 lemmi, e la ricchezza lessicale dell'italiano si traduce spesso in un numero di token diverso rispetto all'inglese per lo stesso concetto. 100% lato client — i tuoi dati non lasciano mai il browser. Nessun upload, nessun tracciamento, nessun log sul server. Utile anche per testi lunghi: il corpus di un romanzo come l'Ulisse di Joyce supera i 265.000 vocaboli, un ordine di grandezza che i context window dei modelli attuali faticano ancora ad assorbire intero. Se lavori anche con encoding di dati, il nostro [Base64 encoder & decoder](/it/base64/) è lo strumento complementare naturale.

Funzionalità

  • Confronto multi-modello. Mostra le stime di token per GPT-4o, GPT-3.5, Claude, Gemini e Llama affiancate, così vedi subito le differenze di tokenizzazione senza cambiare tab.
  • Proiezioni di costo API. Calcola il costo stimato in dollari alle tariffe API pubbliche per ciascun modello, così puoi confrontare prima di chiamare l'endpoint.
  • Statistiche testuali complete. Oltre ai token, riporta caratteri, parole e frasi — utile per rispettare i limiti di piattaforme come sistemi di ticketing o CMS.
  • Nessuna chiave API richiesta. Tutto gira nel browser tramite algoritmi di tokenizzazione approssimata. Non hai bisogno di un account OpenAI o Anthropic per usarlo.
  • Privacy by design. Il testo non lascia mai il tuo dispositivo. Niente richieste di rete, niente log, niente cookie di profilazione — puoi verificarlo aprendo il pannello Network degli strumenti sviluppatore.
  • Interfaccia pulita e copiabile. Un clic copia l'output negli appunti. Comodo per incollarlo direttamente in un documento di analisi o in uno script di automazione.

Come usare il Token Counter

Bastano tre passi: incolla il testo, premi Calcola e leggi i risultati per ogni modello. Non serve configurare nulla.

  1. Incolla il testo. Copia il prompt, il documento o il frammento di codice che vuoi analizzare e incollalo nel campo di testo. Funziona con qualsiasi lingua, incluso l'italiano.
  2. Premi Calcola. Clicca il pulsante Calcola. L'elaborazione avviene istantaneamente nel browser — nessuna chiamata di rete.
  3. Leggi le stime per modello. Ogni riga mostra il modello, i token stimati e il costo API indicativo. Per GPT-4o, ad esempio, 1 000 token di input costano circa $0,005 ai prezzi pubblici attuali.
  4. Copia o confronta. Usa il pulsante Copia per esportare i risultati. Se devi anche codificare payload JSON da inviare all'API, il [URL encoder & decoder](/it/url-encoder/) ti torna utile subito dopo.

Casi d'uso comuni

  • Ottimizzazione dei prompt. Prima di mandare in produzione un prompt di sistema, verifica che rientri nel context window del modello scelto e stima il costo per milione di chiamate.
  • Audit di documenti lunghi. Carica la trascrizione di una riunione o un contratto e controlla se supera il limite di token prima di passarlo a un LLM per la sintesi.
  • Confronto tra modelli per budget fisso. Se hai un budget API mensile definito, usa le proiezioni di costo per capire quale modello è sostenibile per il tuo volume di richieste.
  • Sviluppo di chatbot e agenti. Durante lo sviluppo di un agente conversazionale, monitora la crescita del contesto a ogni turno per evitare troncamenti inattesi a runtime.
  • Ricerca e analisi testuale. Linguisti computazionali e ricercatori possono usare il tool per stimare la densità lessicale di corpus in italiano e confrontarla con testi in altre lingue.

Domande frequenti

I miei testi vengono inviati a qualche server?

No. Tutto il calcolo avviene nel tuo browser. Il testo non lascia mai il dispositivo: puoi aprire il pannello Network degli strumenti sviluppatore e verificare che non parte alcuna richiesta HTTP durante l'analisi.

Perché i token stimati differiscono tra GPT-4o e Claude?

Ogni famiglia di modelli usa un proprio tokenizer con vocabolario diverso. GPT-4o usa cl100k_base, Claude usa un tokenizer proprietario Anthropic, Gemini un altro ancora. La stessa frase in italiano può produrre 10–20% di token in più su un modello rispetto a un altro, motivo per cui confrontarli insieme è più utile che affidarsi a una sola stima.

Come viene calcolato il costo API?

Il tool moltiplica i token stimati per le tariffe pubbliche di input token di ciascun provider, aggiornate al momento della release. I prezzi reali possono variare in base a sconti volume, tier o aggiornamenti del provider — considera la proiezione un ordine di grandezza, non una fattura.

Funziona con testi molto lunghi?

Sì, non c'è limite imposto dal tool. Tieni però presente che l'elaborazione è sincrona nel browser: testi di centinaia di migliaia di parole potrebbero impiegare qualche secondo su dispositivi lenti. I modelli attuali hanno comunque context window nell'ordine di 128K–1M token, e il tool ti segnala quando li superi.

Posso usarlo per l'italiano e altri caratteri non ASCII?

Sì. Il tokenizer approssimato gestisce Unicode completo, compresi caratteri accentati italiani, cirillico, cinese e emoji. Nota che i caratteri non-ASCII tendono a consumare più token per carattere rispetto all'ASCII puro, un fattore rilevante quando si scrive in italiano.

Questo tool è collegato all'openai token counter ufficiale?

No, è uno strumento indipendente e gratuito. OpenAI mette a disposizione la libreria tiktoken per conteggi esatti lato server, ma richiede Python e una chiave API. Questo token counter funziona direttamente nel browser senza dipendenze esterne, con stime molto vicine ai valori reali per la maggior parte dei casi d'uso.