Empresas
Empregos
  • Sobre nós
  • Soluções
    • Publicação de vagas
      Publique sua vaga e receba candidatos qualificados em 48h.
    • Avaliações de candidatos
      Mais de 500 testes técnicos e psicológicos, mais anti-fraude.
    • Headhunting
      Busca executiva personalizada do início ao fim.
    • Folha de Pagamento + EOR
      Dispersão de folha e EOR em mais de 15 países da LATAM.
  • Preços
  • Empregos

0

328
Visualizações
¿Cómo agrupo una columna de pandas para crear una nueva columna de porcentaje?

Tengo un marco de datos de pandas que se ve así:

 mydict ={ 'person': ['Jenny', 'Jenny', 'David', 'David', 'Max', 'Max'], 'fruit': ['Apple', 'Orange', 'Apple', 'Orange', 'Apple', 'Orange'], 'eaten': [25, 75, 15, 5, 10, 10] } df = pd.DataFrame(mydict) person fruit eaten Jenny Apple 25 Jenny Orange 75 David Apple 15 David Orange 5 Max Apple 10 Max Orange 10

Que me gustaría convertir en:

 person apple_percentage orange_percentage Jenny 0.25 0.75 David 0.75 0.25 Max 0.50 0.50

Supongo que tendré que usar groupby de alguna manera para hacer esto, pero ¿no puedo encontrar una forma Pythonic limpia de hacerlo?

over 4 years ago · Santiago Trujillo
3 Respostas
Responde à pergunta

0

Use DataFrame.pivot con división por sum s:

 df = df.pivot('person','fruit','eaten').add_suffix('_percentage') df = df.div(df.sum(axis=1), axis=0) print (df) fruit Apple_percentage Orange_percentage person David 0.75 0.25 Jenny 0.25 0.75 Max 0.50 0.50
over 4 years ago · Santiago Trujillo Relatório

0

Otra opción es la tabulación cruzada de pandas:

 (pd.crosstab(index = df.person, columns = df.fruit, values = df.eaten, aggfunc = 'mean', normalize='index') .add_suffix('_percentage') .rename_axis(columns=None) ) Apple_percentage Orange_percentage person David 0.75 0.25 Jenny 0.25 0.75 Max 0.50 0.50

También podría usar el método de pipe , aunque en este caso, no hace que el código sea más claro (lo que anula el propósito de la función de pipe ):

 (df.assign(eaten = df.groupby('person') .pipe(lambda grp: df.eaten / grp.eaten.transform('sum')) ) .pivot('person', 'fruit', 'eaten') .add_suffix('_percentage') .rename_axis(columns=None) ) Apple_percentage Orange_percentage person David 0.75 0.25 Jenny 0.25 0.75 Max 0.50 0.50
over 4 years ago · Santiago Trujillo Relatório

0

Puede apilar y desapilar () y agregar

 df=df.set_index(['person','fruit']).stack().unstack('fruit').add_suffix('_percentage')#) df = df.div(df.sum(axis=1), axis=0).reset_index().drop(columns='level_1') fruit person Apple_percentage Orange_percentage 0 David 0.75 0.25 1 Jenny 0.25 0.75 2 Max 0.50 0.50
over 4 years ago · Santiago Trujillo Relatório
Responde à pergunta
Encontrar trabalhos remotos

Descubra a nova forma de encontrar um emprego!

melhores empregos
Principais categorias de trabalho
Empresas
Postar vaga Preços Comercial
Jurídico
Termos e Condições Política de privacidade
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomende algumas ofertas para mim
Preciso de ajuda