Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

269
Vistas
En pandas, ¿cómo pivotar un marco de datos en una serie categórica con categorías faltantes?

Tengo un marco de datos de pandas con una serie categórica a la que le faltan categorías.

En el ejemplo que se muestra a continuación, el group tiene las categorías "a" , "b" y "c" , pero no hay casos de "c" en el marco de datos.

 import pandas as pd dfr = pd.DataFrame({ "id": ["111", "222", "111", "333"], "group": ["a", "a", "b", "b"], "value": [1, 4, 9, 16]}) dfr["group"] = pd.Categorical(dfr["group"], categories=["a", "b", "c"]) dfr.pivot(index="id", columns="group")

El marco de datos pivotado resultante tiene columnas a y b . También esperaba una columna c que contuviera todos los valores faltantes.

 value group ab id 111 1.0 9.0 222 4.0 NaN 333 NaN 16.0

¿Cómo puedo girar un marco de datos en una serie categórica para incluir columnas con todas las categorías, independientemente de si estaban presentes en el marco de datos original?

over 4 years ago · Santiago Trujillo
2 Respuestas
Responde la pregunta

0

pd.pivot_table tiene un argumento dropna que dicta descartar o no valorar columnas llenas de NaN.

Intente establecerlo en False :

 import pandas as pd dfr = pd.DataFrame({ "id": ["111", "222", "111", "333"], "group": ["a", "a", "b", "b"], "value": [1, 4, 9, 16]}) dfr["group"] = pd.Categorical(dfr["group"], categories=["a", "b", "c"]) pd.pivot_table(dfr, index="id", columns="group", dropna=False)
over 4 years ago · Santiago Trujillo Denunciar

0

Puedes reindex . Esto funcionará incluso si su columna de value no es numérica (a diferencia pivot_table ):

 output = (dfr.pivot(index="id", columns="group") .reindex(columns=pd.MultiIndex.from_product([["value"], dfr["group"].cat.categories] ) ) ) >>> output value abc id 111 1.0 9.0 NaN 222 4.0 NaN NaN 333 NaN 16.0 NaN
over 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda