Leccion 5.1: Renombrar filas, columnas y Limpieza del Dataframe
Renombrar Filas, Columnas y Limpieza del DataFrame en Pandas
Introducción
En esta lección, Yuscu Mejía nos enseñará cómo renombrar filas y columnas y cómo realizar la limpieza básica de un DataFrame en Pandas. Estas operaciones son esenciales para preparar y limpiar datos antes de su análisis.
Características
Renombrar y limpiar un DataFrame en Pandas ofrece las siguientes características:
- Permite cambiar los nombres de las filas y columnas para mayor claridad y consistencia.
- Facilita la eliminación de datos duplicados y el manejo de valores nulos.
- Ayuda a preparar el DataFrame para un análisis de datos más efectivo.
Ejemplos
A continuación, Yuscu Mejía nos muestra algunos ejemplos de cómo renombrar filas y columnas y cómo realizar la limpieza de un DataFrame:
- Renombrar columnas en un DataFrame.
- Eliminar filas duplicadas.
- Manejar valores nulos.
# Importar pandas
import pandas as pd
# Crear un DataFrame de ejemplo
data = {'Nombre': ['Ana', 'Luis', 'Carlos', 'Ana', 'Jose'],
'Edad': [23, 34, 45, 23, 36],
'Ciudad': ['Madrid', 'Barcelona', 'Madrid', 'Madrid', 'Sevilla']}
df = pd.DataFrame(data)
# Renombrar columnas
df_renombrado = df.rename(columns={'Nombre': 'Nombre_Completo', 'Edad': 'Años'})
print(df_renombrado)
# Eliminar filas duplicadas
df_sin_duplicados = df.drop_duplicates()
print(df_sin_duplicados)
# Manejar valores nulos
df_con_nulos = df.copy()
df_con_nulos.loc[2, 'Edad'] = None
df_sin_nulos = df_con_nulos.fillna(df_con_nulos['Edad'].mean())
print(df_sin_nulos)
Práctica
Aprende a renombrar filas y columnas y a limpiar un DataFrame siguiendo nuestro tutorial en video, presentado por Yuscu Mejía:
Ejercicio 1: Renombrar columnas
Renombra las columnas de un DataFrame de ejemplo.
- a) Cambia el nombre de la columna ‘Nombre’ a ‘Nombre_Completo’ y ‘Edad’ a ‘Años’.
Ejercicio 2: Eliminar duplicados y manejar valores nulos
Elimina filas duplicadas y maneja los valores nulos en un DataFrame de ejemplo.
- a) Elimina las filas duplicadas.
- b) Rellena los valores nulos con la media de la columna correspondiente.
#Ejercicio 1
a) Renombra las columnas
import pandas as pd
# Crear un DataFrame de ejemplo
data = {'Nombre': ['Ana', 'Luis', 'Carlos', 'Ana', 'Jose'],
'Edad': [23, 34, 45, 23, 36],
'Ciudad': ['Madrid', 'Barcelona', 'Madrid', 'Madrid', 'Sevilla']}
df = pd.DataFrame(data)
# Renombrar columnas
df_renombrado = df.rename(columns={'Nombre': 'Nombre_Completo', 'Edad': 'Años'})
print(df_renombrado)
#Ejercicio 2
a) Elimina las filas duplicadas
# Eliminar filas duplicadas
df_sin_duplicados = df.drop_duplicates()
print(df_sin_duplicados)
b) Rellena los valores nulos
# Manejar valores nulos
df_con_nulos = df.copy()
df_con_nulos.loc[2, 'Edad'] = None
df_sin_nulos = df_con_nulos.fillna(df_con_nulos['Edad'].mean())
print(df_sin_nulos)

