Eliminar duplicados en Pandas
drop_duplicates() elimina filas repetidas. Puedes indicar columnas y si conservar la primera o última ocurrencia.
Esta lección introduce una librería o módulo usado en ciencia de datos con Python. Instálalo con pip en local; en el editor de The Data Schools muchas ya vienen precargadas.
Importa, ejecuta el ejemplo mínimo y solo después pasa a casos más complejos.
En esta lección verás concepto de Python de forma clara, con explicación paso a paso y ejemplos que puedes ejecutar en el editor de Python de The Data Schools.
Idea clave
Antes del código, fíjate en el objetivo: dominar <strong>Eliminar duplicados en Pandas</strong> te permitirá escribir programas más claros y mantenibles.
Lee el ejemplo completo, ejecútalo y luego modifica un valor para ver qué cambia en la salida. Esa experimentación es la forma más rápida de aprender.
drop_duplicates
Por defecto conserva la primera aparición de cada fila duplicada.
Quitar duplicados
import pandas as pd
df = pd.DataFrame({'nombre': ['Ana', 'Luis', 'Ana'], 'edad': [30, 25, 30]})
print(df.drop_duplicates())
Practica variando el ejemplo
Repite el patrón anterior con tus propios datos. Cambia nombres, números o condiciones y observa el resultado en consola.
Variante de Quitar duplicados
import pandas as pd
df = pd.DataFrame({'nombre': ['Ana', 'Luis', 'Ana'], 'edad': [30, 25, 30]})
print(df.drop_duplicates())
print('--- Fin del ejemplo ---')
Errores frecuentes
Olvidar la indentación correcta en bloques if, for o def.
Confundir = (asignación) con == (comparación).
No importar un módulo antes de usarlo (por ejemplo, olvidar import math).
Resumen
<ul class="list-container"><li>Has practicado Eliminar duplicados en Pandas con código ejecutable.
Cómo practicar
1. Pulsa Ejecutar en el bloque de código.
2. Modifica un valor o argumento.
3. Vuelve a ejecutar y observa la consola.