Tengo un DataFrame como
name col1 col2 a aa 123 a bb 123 b aa 234y una lista
[1, 2, 3]Quiero reemplazar el col2 de cada fila con col1 = 'aa' con la lista como
name col1 col2 a aa [1, 2, 3] a bb 123 b aa [1, 2, 3]Probé algo como
df.loc[df[col1] == 'aa', col2] = [1, 2, 3]pero me da el error:
ValueError: could not broadcast input array from shape (xx,) into shape (yy,)¿Cómo debo evitar esto?
Una lista de comprensión con un if/else debería funcionar
df['col2'] = [x['col2'] if x['col1'] != 'aa' else [1,2,3] for ind,x in df.iterrows()]Será seguro hacerlo con bucle for
df.col2 = df.col2.astype(object) for x in df.index: if df.at[x,'col1'] == 'aa': df.at[x,'col2'] = [1,2,3] df name col1 col2 0 a aa [1, 2, 3] 1 a bb 123 2 b aa [1, 2, 3]También puedes usar:
data = {'aa':[1,2,3]} df['col2'] = np.where(df['col1'] == 'aa', df['col1'].map(data), df['col2'])Debe usar esto con cuidado, ya que al hacerlo cambiará la lista a ambas ubicaciones:
df['col2'].loc[0].append(5) print(df) #OUTPUT name col1 col2 0 a aa [1, 2, 3, 5] 1 a bb 123 2 b aa [1, 2, 3, 5]Pero esto está bien:
df = df.loc[1:] print(df) #OUTPUT name col1 col2 1 a bb 123 2 b aa [1, 2, 3]Hazlo simple. np.dónde debe hacer. Código a continuación
df['col2']=np.where(df['col1']=='aa', str(lst), df['col2'])Alternativamente, use pd.Series con la lista bloqueada entre corchetes dobles
df['col2']=np.where(df['col1']=='aa', pd.Series([lst]), df['col2'])import pandas as pd df = pd.DataFrame({"name":["a","a","b"],"col1":["aa","bb","aa"],"col2":[123,123,234]}) l = [1,2,3] df["col2"] = df.apply(lambda x: l if x.col1 == "aa" else x.col2, axis =1) df