Suppresseur de doublons de tableau Python

Filtrez les éléments en double d'une liste Python tout en conservant leur ordre d'insertion d'origine.

Essayez dans l'éditeur

Aperçu

La suppression des doublons est l’une des opérations de nettoyage de données les plus courantes dans les logiciels.

La conversion d'une liste en un ensemble (`set(arr)`) supprime les doublons mais détruit l'ordre des éléments car les ensembles ne sont pas ordonnés.

Pour supprimer les doublons tout en préservant l'ordre, nous parcourons la liste et suivons les éléments vus dans un ensemble, en ajoutant de nouveaux à une liste de résultats.

Sortie de code et d'exécution

Accumulateur efficace d'éléments uniques préservant l'ordre O(n).

remove_duplicates.py
Essayez dans l'éditeur
def remove_duplicates(arr):
    seen = set()
    result = []
    for item in arr:
        if item not in seen:
            seen.add(item)
            result.append(item)
    return result

sample_list = [1, 2, 2, 3, 4, 4, 1, 5]
print("Original:", sample_list)
print("Unique:  ", remove_duplicates(sample_list))
Sortie terminale
Original: [1, 2, 2, 3, 4, 4, 1, 5]
Unique:   [1, 2, 3, 4, 5]

Mise en œuvre étape par étape

  • Désinfection de l'historique de recherche et des journaux d'enregistrement de transactions
  • Préparation d'une liste de clés de données uniques pour les requêtes SQL
  • Nettoyage des tableaux pour le mappage de visualisation

Foire aux questions

Quel est le moyen le plus rapide de procéder dansPython 3.7+ ?

PuisquePython 3.7+ préserve l'ordre d'insertion du dictionnaire, vous pouvez exécuter `list(dict.fromkeys(arr))` pour supprimer les doublons tout en maintenant l'ordre en une seule étape optimisée.

Sujets connexes