PythonPandasAide-mémoire pour l'analyse des données
Guide de référence pour les sériesPandaset DataFrames. Apprenez le chargement, le nettoyage, la sélection, le regroupement et les agrégations de données.
Chargement des données et inspection initiale
Opérations pour charger des ensembles de données et inspecter leurs contours structurels.
| Méthode / Fonction | Syntaxe | Descriptif |
|---|---|---|
| pd.DataFrame() | pd.DataFrame(data, columns=...) | Construit une structure de données étiquetée en deux dimensions avec des colonnes. |
| pd.read_csv() | pd.read_csv(filepath) | Charge un fichier CSV dans un DataFramePandas. |
| head() / tail() | df.head(n=5) / df.tail(n=5) | Renvoie les n premières ou les n dernières lignes du DataFrame. |
| info() | df.info() | Imprime un résumé concis des colonnes DataFrame, des décomptes non nuls et de l'utilisation de la mémoire. |
| describe() | df.describe() | Génère des statistiques descriptives résumant la tendance centrale, la dispersion et la forme. |
Sélection, filtrage et nettoyage des données
Méthodes pour découper les colonnes/lignes, agréger les données et résoudre les enregistrements manquants.
| Méthode / Fonction | Syntaxe | Descriptif |
|---|---|---|
| loc[] | df.loc[row_label, col_label] | Accède à un groupe de lignes et de colonnes par étiquettes. |
| iloc[] | df.iloc[row_pos, col_pos] | Accède à un groupe de lignes et de colonnes par positions d’index entier. |
| groupby() | df.groupby(col).mean() | Regroupe les lignes partageant des valeurs de colonne et agrège les champs numériques. |
| value_counts() | df[col].value_counts() | Renvoie une série contenant le nombre de valeurs uniques dans la colonne. |
| dropna() | df.dropna(axis=0) | Supprime les lignes (ou colonnes) qui contiennent des valeurs manquantes ou nulles. |
| fillna() | df.fillna(value) | Remplit les valeurs manquantes avec une valeur ou une stratégie spécifiée. |
Script de démonstration interactif
# pd.DataFrame()
pd.DataFrame(data, columns=...)
# pd.read_csv()
pd.read_csv(filepath)
# head() / tail()
df.head(n=5) / df.tail(n=5)
# info()
df.info()
# describe()
df.describe()
# loc[]
df.loc[row_label, col_label]
# iloc[]
df.iloc[row_pos, col_pos]
# groupby()
df.groupby(col).mean()
# value_counts()
df[col].value_counts()
# dropna()
df.dropna(axis=0)
# fillna()
df.fillna(value)Foire aux questions
Quelle est la différence entre loc et iloc ?
loc est une indexation basée sur des étiquettes (sélectionne les données par noms de ligne/colonne), tandis qu'iloc est une indexation basée sur des entiers (sélectionne les données par position d'index).
Comment gérez-vous les valeurs manquantes dansPandas?
Utilisez dropna() pour supprimer les lignes/colonnes avec des valeurs nulles, ou utilisez fillna(value) pour remplacer les valeurs nulles par une valeur par défaut spécifique.
Sujets connexes
Guide de référence rapide pour les baiesNumPy. Apprenez la création de tableaux, le remodelage, l'indexation, le découpage et les opérations mathématiques.
Aide-mémoire sur les collections et structures de données PythonGuide complet du module de collections Python et des structures de données natives. Apprenez les listes, les dictés, les ensembles, les tuples, les deques et les tuples nommés.
Aide-mémoire sur les fonctions intégrées PythonGuide de référence des fonctions intégrées de Python. Apprenez à utiliser print, len, range, enumerate, zip, map, filter, etc.
Ressources Python recommandées
Développez vos connaissances avec des didacticiels interactifs, des aide-mémoire et des comparaisons de codes associés.
Boucles Python
Apprenez à utiliser les boucles Python pour parcourir les données. Maîtrisez les bonnes pratiques pour les boucles, while, break, continue et loop avec des exemples interactifs.
Comment trier une liste en Python
Apprenez à trier une liste en Python à l'aide de la méthode sort() et de la fonction sorted(). Découvrez des exemples de tri de clés personnalisé et d’ordre inverse.
Python vs JavaScript : quel langage de programmation est le meilleur ?
Une comparaison complète entre Python et JavaScript. Explorez les différences de syntaxe, les performances, les cas d'utilisation (backend et frontend) et des exemples de codage.