Tengo un marco de datos de pandas que se parece a lo siguiente:
Name Missed Credit Grade A 1 3 10 A 1 1 12 B 2 3 10 B 1 2 20Y mi resultado deseado es:
Name Sum1 Sum2 Average A 2 4 11 B 3 5 15 Básicamente para obtener la suma de la columna Credit y Missed y hacer un promedio en Grade . Lo que estoy haciendo en este momento es dos grupos en Name y luego obtengo la suma y el promedio y finalmente fusiono los dos marcos de datos de salida, lo que no parece ser la mejor manera de hacerlo. También encontré esto en SO que tiene sentido si quiero trabajar solo en una columna:
df.groupby('Name')['Credit'].agg(['sum','average'])¿Pero no está seguro de cómo hacer una sola línea para ambas columnas?
Necesita agg por dictionary y luego rename el nombre de las columnas:
d = {'Missed':'Sum1', 'Credit':'Sum2','Grade':'Average'} df=df.groupby('Name').agg({'Missed':'sum', 'Credit':'sum','Grade':'mean'}).rename(columns=d) print (df) Sum1 Sum2 Average Name A 2 4 11 B 3 5 15 Si desea también crear una columna desde Name :
df = (df.groupby('Name', as_index=False) .agg({'Missed':'sum', 'Credit':'sum','Grade':'mean'}) .rename(columns={'Missed':'Sum1', 'Credit':'Sum2','Grade':'Average'})) print (df) Name Sum1 Sum2 Average 0 A 2 4 11 1 B 3 5 15Solución con agregaciones nombradas:
df = df.groupby('Name', as_index=False).agg(Sum1=('Missed','sum'), Sum2= ('Credit','sum'), Average=('Grade','mean')) print (df) Name Sum1 Sum2 Average 0 A 2 4 11 1 B 3 5 15A = pd.DataFrame.from_dict({'Name':['A','A','B','B'],'Missed':[1,1,2,1],'Credit':[3,1,3,2],'Grades':[10,12,10,20]}) A.groupby('Name').agg({'Missed':'sum','Credit':'sum','Grades':'mean'})