acento.io
Udviklerværktøj

Token Counter

Estimer tokens og API-omkostninger på tværs af fem LLM-familier uden at uploade en eneste byte til en server.

Af Carlos Suárez , Systemingeniør
Sidst opdateret:

Hvad dette Token Counter gør

Når du kalder en LLM-API, betaler du per token — ikke per ord. En token er typisk fire tegn på engelsk, men sproget spiller en stor rolle: det danske alfabet består af 29 bogstaver, herunder æ, ø og å, som tokeniseringsmodellerne håndterer anderledes end de 26 latinske. Det betyder, at dansk tekst ofte bruger flere tokens end tilsvarende engelsk. Denne danske version af Token Counter beregner estimater for GPT-4o, GPT-3.5, Claude, Gemini og Llama i ét enkelt kald — og viser desuden tegn-, ords- og sætningsantal samt prisoverslag ved typiske API-takster. 100 % klient-side — dine data forlader aldrig din browser. Ingen upload, ingen sporing, ingen serverlogfiler. Har du brug for andre tekstværktøjer, dækker vores [URL encoder & decoder](/da/url-encoder/) URL-kodning helt uden server.

Funktioner

  • Fem modelfamilier på én gang. Se token-estimater for GPT-4o, GPT-3.5, Claude, Gemini og Llama side om side uden at skifte fane eller vælge model på forhånd.
  • Prisoverslag ved API-takster. Beregningen inkluderer typiske input-priser per million tokens, så du hurtigt kan vurdere omkostningerne for et prompt eller en batch.
  • Tegn, ord og sætninger. Ud over tokens får du karakter-, ords- og sætningsantal — nyttigt når du optimerer til modeller med kontekstvindue-grænser.
  • Fuld fortrolighed. Al behandling sker i din browser via JavaScript. Ingen API-nøgle kræves, ingen data sendes til nogen server. Som defineret i Web Crypto API W3C Recommendation kan browsere i dag håndtere avanceret tekstbehandling lokalt.
  • Understøtter unicode og nordiske tegn. æ, ø og å tæller korrekt. Tokeniseringsestimater tager højde for, at nordiske specialtegn typisk koder som ekstra bytes.
  • Øjeblikkelig feedback. Resultater opdateres løbende mens du skriver, så du ikke behøver trykke Beregn ved hver rettelse.

Sådan bruger du Token Counter

Indsæt din tekst i feltet og tryk Beregn — resultater for alle modeller vises med det samme.

  1. Indsæt teksten. Kopiér dit prompt, din artikel eller kodeblok ind i tekstfeltet. For eksempel en systembesked som "Du er en hjælpsom assistent der svarer kortfattet.".
  2. Tryk Beregn. Klik på Beregn-knappen. Token-estimater for alle fem modelfamilier beregnes lokalt i din browser.
  3. Sammenlign modeller. Se kolonnen for den model du bruger og notér token-antallet. Husk at GPT-4o og Claude tokeniserer forskelligt, særligt for ikke-engelske sprog.
  4. Vurdér omkostningerne. Brug prisoverslaget til at afgøre om du bør forkorte prompten eller opdele anmodningen i mindre kald.
  5. Kopiér resultatet. Klik Kopiér for at gemme output til udklipsholderen og indsætte det i dit regneark eller notat.

Typiske anvendelser

  • Prompt-optimering til produktion. Udviklere der bygger chatbots eller RAG-pipelines bruger værktøjet til at sikre at systembesked + kontekst holder sig under modellens kontekstvindue.
  • Budgettering af batch-API-kald. Inden du sender tusindvis af dokumenter til OpenAI-API'et, kan du estimere den samlede pris ved at teste et repræsentativt uddrag her.
  • Indholdsoptimering til SEO og LLM-indsendelse. Googles første SERP-resultat indeholder i gennemsnit 1.447 ord — men til LLM-summarisering er kortere chunks ofte mere effektive. Brug token-tallene til at finde den rette balance.
  • Undervisning og forskning. Studerende og forskere der arbejder med NLP kan hurtigt illustrere, hvordan tokenisering varierer mellem arkitekturer uden at installere Python-pakker.
  • Teknisk dokumentation. Tekniske skribenter der leverer dokumentation til LLM-drevne søgninger kan tjekke at hvert afsnit passer inden for anbefalede token-grænser.

Ofte stillede spørgsmål

Er mine data sikre når jeg bruger dette værktøj?

Ja. Al beregning foregår 100 % lokalt i din browser. Ingen tekst sendes til en server, ingen API-nøgle kræves, og der gemmes ingen logfiler. Du kan endda bruge værktøjet offline.

Hvad er forskellen på tokens og ord?

Et token svarer groft til fire tegn på engelsk. Dansk og andre nordiske sprog med specialtegn som æ, ø og å tokeniseres typisk lidt anderledes — et enkelt dansk ord kan fylde to tokens der hvor et engelsk ord fylder ét.

Hvorfor viser GPT-4o og Claude forskellige tokenantal for den samme tekst?

Hver model bruger sin egen tokenizer. GPT-modeller bruger tiktoken med BPE-algoritmen, mens Claude anvender en Anthropic-specifik tokenizer. Forskellene er normalt små for engelsk, men kan være større for unicode-tunge sprog.

Kan jeg bruge dette som OpenAI token counter?

Ja. Estimaterne for GPT-4o og GPT-3.5 er beregnet med de samme principper som OpenAIs tiktoken-bibliotek og er velegnede til budgettering af openai token counter-behov. For præcise tal til fakturering bør du altid krydstjekke mod OpenAIs egne API-svar.

Hvad er et kontekstvindue?

Kontekstvinduet er det maksimale antal tokens en model kan behandle i ét kald — både input og output tilsammen. GPT-4o understøtter op til 128.000 tokens, mens nyere Claude-modeller går helt op til 200.000. Overskrider du grænsen, afskæres teksten eller kaldet fejler.

Kan jeg kombinere dette med andre værktøjer på siden?

Absolut. Arbejder du med data der skal kodes eller hashes inden du sender dem til en API, kan du bruge vores [Base64 encoder & decoder](/da/base64/) til kodning — og derefter estimere tokens på det kodede output her.