Estoy tratando de usar python para leer mi archivo csv, extraer columnas específicas a un pandas.dataframe y mostrar ese marco de datos. Sin embargo, no veo el marco de datos, recibo Series ([], dtype: object) como salida. A continuación se muestra el código con el que estoy trabajando: Mi documento consta de: producto sub_problema del producto sub_problema consumidor_queja_narrativa
company_public_response etiquetas de código postal del estado de la empresa
consentimiento_del_consumidor_provisto_enviado_vía_fecha_enviado_a_la_empresa
empresa_respuesta_al_consumidor respuesta_oportuna_consumidor_en disputa?
queja_id
Quiero extraer: sub_problema del producto sub_problema consumidor_queja_narrativa
import pandas as pd df=pd.read_csv("C:\\....\\consumer_complaints.csv") df=df.stack(level=0) df2 = df.filter(regex='[BF]') df[df2]import pandas as pd input_file = "C:\\....\\consumer_complaints.csv" dataset = pd.read_csv(input_file) df = pd.DataFrame(dataset) cols = [1,2,3,4] df = df[df.columns[cols]]Aquí especifique los números de columna que desea seleccionar. En el marco de datos, la columna comienza desde el índice = 0
cols = []También puede seleccionar la columna por nombre. Solo usa la siguiente línea
df = df[["Column Name","Column Name2"]]Una forma sencilla de conseguirlo sería la siguiente:
df = pd.read_csv("C:\\....\\consumer_complaints.csv") df2 = df.loc[:,'B':'F']Espero que ayude.
Esto funcionó para mí, usando el corte:
df=pd.read_csv df1=df[n1:n2] Donde $n1<n2# son ambas columnas en el rango, por ejemplo: si desea las columnas 3-5, use
df1=df[3:5]Para la primera columna, utilice
df1=df[0]Aunque no estoy seguro de cómo seleccionar un rango discontinuo de columnas.
También podemos usar i.loc. Datos dados en dataset2:
conjunto de datos2.iloc[:3,[1,2]]
Escupirá las 3 filas superiores de las columnas 2-3 (recuerde que la numeración comienza en 0)
Entonces dataset2.iloc[:3,[1,2]] escupe