Tengo un DataFrame de pandas como se muestra a continuación.
df = pd.DataFrame({ 'date': ['2011-01-01', '2011-01-01', '2011-02-01', '2011-02-01', '2011-03-01', '2011-03-01', '2011-04-01', '2011-04-01'], 'category': [1, 2, 1, 2, 1, 2, 1, 2], 'rate': [0.5, 0.75, np.nan, np.nan, 1, 1.25, np.nan, np.nan] }) Quiero usar ffill para reenviar los valores de rate , excepto que quiero que cada valor corresponda también a la category apropiada. ¿Cómo puedo hacer que df se vea así?:
df category date rate 1 2011-01-01 0.50 2 2011-01-01 0.75 1 2011-02-01 0.50 2 2011-02-01 0.75 1 2011-03-01 1.00 2 2011-03-01 1.25 1 2011-04-01 1.00 2 2011-04-01 1.25Usar groupby :
df.groupby('category').ffill()Producción:
category date rate 0 1 2011-01-01 0.50 1 2 2011-01-01 0.75 2 1 2011-02-01 0.50 3 2 2011-02-01 0.75 4 1 2011-03-01 1.00 5 2 2011-03-01 1.25 6 1 2011-04-01 1.00 7 2 2011-04-01 1.25Si tiene otras columnas con NaN que no desea completar, puede usar esto para completar NaN en la columna de tasa:
df['rate'] = df.groupby('category')['rate'].ffill()