Estoy usando el siguiente código para convertir archivos .xlsx en archivos .csv.
import pandas as pd data_xls = pd.read_excel('excelfile.xlsx', 'Sheet2', index_col=None) data_xls.to_csv('csvfile.csv', encoding='utf-8')El código funciona, sin embargo, obtengo una columna de índice con los números de celda que no quiero. ¿Hay alguna forma de no incluir o eliminar esa columna de índice?
Salida de archivo
Unnamed Data 0 0.99319613 1 0.99319613 2 0.99319613 3 0.99319613 4 0.99319613 5 0.99319613Como se indica en los documentos para pandas.DataFrame.to_csv() , simplemente pase index=False como argumento de palabra clave para excluir los nombres de las filas.
data_xls.to_csv('csvfile.csv', encoding='utf-8', index=False)Inspírate en miradulo y soluciona un problema de conversión de números:
import pandas as pd data_xls = pd.read_excel('excelfile.xlsx', 'Sheet2', dtype=str, index_col=None) data_xls.to_csv('csvfile.csv', encoding='utf-8', index=False)Puede soltar 'Hoja2' si hay una hoja. dtype=str para evitar la conversión de números.