Naar de inhoud
helpyself

Dubbele regels verwijderen

Local only — nothing is uploaded unless you save or share it.

Haal dubbele regels, lege regels en losse spaties in één keer uit een lijst.

  1. Plak je lijst, één item per regel
  2. Kies of hoofdletters meetellen en of het resultaat gesorteerd wordt
  3. Schoon hem op en kopieer of download de lijst

Deel een link

Bewaart dit in je bestanden en geeft je een adres dat iedereen kan openen. Hij vervalt vanzelf.

Link blijft geldig
Bewaar deze tool

Houd Dubbele regels verwijderen bij de hand

Bewaar als bladwijzer

Over deze tool

Lijsten komen binnen vol herhalingen — e-mailadressen uit drie bronnen bij elkaar geplakt, een log met honderd keer dezelfde fout, een met de hand samengestelde trefwoordenlijst. De dubbele eruit halen is triviaal in een shell en omslachtig overal elders, en daarom eindigen mensen met het sorteren van een spreadsheetkolom en het op het oog verwijderen van rijen. Het zijn de details die het betrouwbaar maken. Twee regels die alleen verschillen door een spatie aan het eind zijn vrijwel altijd dezelfde regel, en het verschil is onzichtbaar, dus wordt er standaard bijgesneden. De vergelijking negeert hoofdletters tenzij je anders vraagt, want hetzelfde adres op twee manieren geschreven is nog steeds één adres. De oorspronkelijke volgorde blijft behouden: de eerste keer dat elke regel voorkomt overleeft, zodat de opgeschoonde lijst nog steeds te leggen is naast waar je mee begon. Je kunt het geheel ook omdraaien en alleen de items zien die zich herhaalden, de andere helft van dezelfde vraag, waarvoor je anders twee bestanden met de hand zou vergelijken. Het sorteren begrijpt letters met tekens, dus een Deense lijst komt niet terug met æ, ø en å op een kluitje aan het eind.

Veelgestelde vragen

Blijft mijn lijst in de oorspronkelijke volgorde?

Ja, tenzij je ervoor kiest te sorteren. De eerste keer dat elke regel voorkomt blijft staan waar hij stond en latere kopieën gaan eruit, dus het resultaat sluit nog aan op de lijst die je plakte. Zo is makkelijk na te gaan wat eruit is gehaald.

Hoe vind ik dubbele regels in plaats van ze te verwijderen?

Wissel van modus: in plaats van een schone lijst krijg je alleen de items die zich herhalen, met een telling. Dat is de nuttige richting als de dubbele juist de bevinding zijn — twee exports die hadden moeten kloppen, een mailinglijst met iemand er twee keer in. Het klusje heeft meerdere namen, lijst ontdubbelen daaronder, maar dubbele regels online verwijderen en dit zijn dezelfde ene ronde.

Waarom worden twee ogenschijnlijk identieke regels niet gematcht?

Vrijwel altijd door witruimte aan het eind, die je niet ziet. Laat de bijsnijdoptie aan staan en het maakt niet uit. De andere oorzaak is een verschil in hoofdlettergebruik in combinatie met hoofdlettergevoeligheid aan.

Kan ik zien welke regels dubbel waren in plaats van ze te verwijderen?

Ja. Zet de optie aan om alleen dubbele te tonen en je krijgt één item voor elke regel die meer dan eens voorkwam, in de volgorde waarin ze het eerst gezien werden. Het is de snelste manier om de herhaalde adressen in een mailinglijst te vinden.

Moet ik de eerste of de laatste kopie van een dubbele houden?

De eerste als de volgorde ertoe doet, en dat is de standaard. De laatste wanneer latere items recenter zijn, zoals in een log waar de nieuwste regel de eerdere vervangt. Hoe dan ook blijft er van elke regel maar één kopie over.

Wordt mijn tekst ergens geüpload?

Nee. Het geheel draait in je browser, dus er gaat niets naar een server. Er is ook een REST-API voor dezelfde bewerking als je lijsten vanuit een script wilt opschonen, en die verwerkt noodgedwongen op de server.

Help deze tool beter te maken

Een fout gevonden, iets anders willen, of mis je een tool?

/duplicate-line-remover

↑↓ om te bewegen · Enter om te openen · Esc om te sluiten