acento.io
Tekstværktøj

Fjern dubletter

Rens din liste for dubletter på sekunder — bevarar den oprindelige rækkefølge, og dine data forlader aldrig din browser.

Af Carlos Suárez , Systemingeniør
Sidst opdateret:

Hvad dette remove duplicates gør

Har du en liste med gentagne linjer — fra et Excel-ark, en CSV-eksport eller copy-paste fra en log — og vil du hurtigt fjerne dubletterne? Dette dansk-sprogede værktøj gør det direkte i browseren: indsæt listen, vælg separator (linjeskift, komma eller semikolon), og du får straks en ren liste tilbage. I modsætning til de fleste online deduplikatorer bevarer vi den oprindelige rækkefølge som standard, så du ikke mister din prioritetssortering. Trim-funktionen løser den stille fælde, hvor ' æble' og 'æble' ser ens ud, men teknisk er to separate elementer — præcis som ...new Set(arr) i JavaScript ikke fanger det. Dansk Sprognævn registrerer over 100.000 opslagsord i Den Danske Ordbog; selv store ordlister renses på under ét sekund. 100 % klient-side — dine data forlader aldrig din browser. Ingen upload, ingen sporing, ingen serverlogfiler.

Funktioner

  • Bevar original rækkefølge. Dubletter fjernes, men de resterende elementer beholder præcis den rækkefølge, du indsatte dem i. Ingen tvungen sortering.
  • Trim usynlige mellemrum. Aktivér trim, og ' æble' behandles som 'æble'. Løser den klassiske fejl, der opstår ved CSV-eksport fra Excel eller Google Sheets.
  • Versalfølsomhed til/fra. Slå versalfølsomhed fra, og 'Email' og 'email' tæller som det samme element — praktisk ved e-maillister og brugernavne.
  • Fleksibel separator. Vælg linjeskift, komma eller semikolon. Perfekt til både rå tekstlister og kommaseparerede kolonner kopieret fra et regneark.
  • Live tæller. Se øjeblikkeligt antal inputelementer, unikke elementer og præcis hvor mange dubletter der blev fjernet — ingen gætteri.
  • Valgfri alfabetisk sortering. Behøver du et sorteret resultat alligevel? Slå sorteringen til som et ekstra trin — uafhængigt af deduplikeringen. Tekstsegmentering følger Unicode TR #29 for korrekt håndtering af sammensatte tegn.

Sådan bruger du remove duplicates

Tre trin er alt, hvad det kræver. Ingen installation, ingen konto.

  1. Indsæt din liste. Kopiér elementerne fra Excel, Google Sheets, en logfil eller et tekstdokument og indsæt dem i inputfeltet.
  2. Vælg indstillinger. Sæt separatoren (linjeskift er standard), slå trim til hvis du mistænker skjulte mellemrum, og vælg om søgningen skal være versalfølsom. I Python hedder den ordrebevarende pendant list(dict.fromkeys(items)) — her sker det automatisk.
  3. Kopiér resultatet. Den rensede liste vises straks i outputfeltet med en tæller over fjernede dubletter. Tryk Kopiér, og du er klar.
  4. Sammenlign før og efter. Vil du se præcis hvad der ændrede sig linje for linje? Brug [text diff](/da/text-diff/) til en detaljeret sammenligning af input og output.

Typiske anvendelser

  • Rens e-maillister før udsendelse. Dubletter i en mailliste koster ekstra afsendelser og ødelægger din afsenderomdømme. Indsæt listen, slå versalfølsomhed fra, og eksportér en ren liste til dit e-mailsystem.
  • Deduplikér Excel- og Google Sheets-kolonner. Kopier en kolonne direkte fra et regneark, rens den her, og sæt den rene version ind igen — hurtigere end Excels indbyggede 'Fjern dubletter' for ad hoc-opgaver.
  • Unikke tags og nøgleord. Sammensætter du nøgleordslister fra flere CSV-eksporter? Brug komma-separator, trim mellemrum, og få en ren, unik liste klar til dit CMS eller regneark.
  • Rens copy-paste fra logfiler. Log-linjer gentages tit ved fejlsøgning. Indsæt de relevante linjer, og se straks, hvilke meddelelser der optræder mere end én gang. Har du brug for at normalisere store/kleine bogstaver bagefter, hjælper [case converter](/da/case-converter/) dig videre.
  • Datasanering ved fletning af eksporter. Når du fusionerer to dataudtræk, opstår der næsten altid overlappende rækker. En hurtig deduplikering her sparer fejl senere i pipelinen.

Ofte stillede spørgsmål

Sender I mine data til en server?

Nej. Al behandling sker i din browser med JavaScript. Dine data forlader aldrig din enhed — ingen upload, ingen logfiler, ingen sporing. Det gælder uanset listens størrelse.

Hvorfor fjernes ' æble' og 'æble' ikke, selvom de ser ens ud?

Det skyldes skjulte mellemrum. JavaScript's [...new Set(arr)] sammenligner strenge byte for byte, så ' æble' og 'æble' er teknisk to forskellige værdier. Slå Trim whitespace til, og begge normaliseres til 'æble' inden sammenligning.

Kan jeg fjerne dubletter fra en Excel-kolonne uden at åbne Excel?

Ja. Markér kolonnen i Excel eller Google Sheets, kopiér (Ctrl+C), indsæt her med linjeskift som separator, og kopiér resultatet tilbage. Det er ofte hurtigere end at bruge Excels indbyggede 'Fjern dubletter'-funktion til hurtige opgaver.

Bevarerværktøjet rækkefølgen?

Ja, som standard bevares den oprindelige rækkefølge. Det er anderledes end bash-kommandoen sort file.txt | uniq, som altid sorterer output. Alfabetisk sortering er valgfri og kan slås til separat.

Fungerer det med kommaseparerede lister fra CSV-filer?

Ja. Skift separator til Komma, og hvert kommaafgrænset element behandles individuelt. Brug Trim for at undgå at mellemrum efter kommaer skaber falske dubletter ved Excel-eksport.

Er der en grænse for listens størrelse?

Der er ingen kunstig grænse. For meget store lister (100.000+ elementer) kan browseren kortvarigt fryse, fordi al behandling sker på main thread. Del i så fald listen op i mindre bidder.