Tengo un enorme archivo csv con más de 500.000 líneas. Quiero agregar una cantidad a la columna "Precio" a través de la terminal en Ubuntu. Intenté usar awk (¿la mejor solución?) pero no sé cómo. (También necesito mantener el encabezado en el nuevo archivo)
Aquí hay un ejemplo del archivo.
"Productno.";"Description";"Price";"Stock";"Brand" "/5PL0006";"Drum Unit";"379,29";"10";"Kyocera" "00096103";"Main pcb HUK, OP6w";"882,00";"0";"OKI" "000J";"Drum, 7033/7040 200.000";"4306,00";"0";"Minolta"Por ejemplo, quiero agregar 125 al precio para que el resultado sea:
"Productno.";"Description";"Price";"Stock";"Brand" "/5PL0006";"Drum Unit";"504,29";"10";"Kyocera" "00096103";"Main pcb HUK, OP6w";"1007,00";"0";"OKI" "000J";"Drum, 7033/7040 200.000";"4431,00";"0";"Minolta"$ awk 'BEGIN {FS=OFS="\";\""} NR>1 {$3 = sprintf("%.2f", $3+125)}1' p.txt "Productno.";"Description";"Price";"Stock";"Brand" "/5PL0006";"Drum Unit";"504,29";"10";"Kyocera" "00096103";"Main pcb HUK, OP6w";"1007,00";"0";"OKI" "000J";"Drum, 7033/7040 200.000";"4431,00";"0";"Minolta" Tenga en cuenta que esto requiere un valor de la variable de entorno LC_NUMERIC que espera , como separador decimal (yo tenía el mío configurado en LC_NUMERIC="de_DE" , por ejemplo).
Para obtener más SECA, puede pasar la cantidad que desea agregar con -v :
$ awk -vn=125 'BEGIN {FS=OFS="\";\""} NR>1 {$3 = sprintf("%.2f", $3+n)}1' p.txt Si no le importa mucho el formato (es decir, si es aceptable "4431" en lugar de "4431,00" ), puede omitir el sprintf :
$ awk -vn=125 'BEGIN {FS=OFS="\";\""} NR>1 {$3+=n}1' p.txt EDITAR : configure FS y OFS en el bloque BEGIN , en lugar de hacerlo de forma independiente a través de -v , como se sugiere en los comentarios (para asegurarse de que reciben el mismo valor, ya que es importante que sean iguales).
¡Perl al rescate! Guardar como add-price , ejecutar como perl add-price input.csv 125 .
#!/usr/bin/perl use warnings; use strict; use Text::CSV; my ($file, $add) = @ARGV; my $csv = 'Text::CSV'->new({ binary => 1, sep_char => ';', eol => "\n", always_quote => 1, }) or die 'Text::CSV'->error_diag; open my $IN, '<', $file or die $!; open my $OUT, '>', "$file.new" or die $!; while (my $row = $csv->getline($IN)) { if (1 != $csv->record_number) { my $value = $row->[2]; $value =~ s/,/./; $value = sprintf "%.2f", $value + $add; $value =~ s/\./,/; $row->[2] = $value; } $csv->print($OUT, $row); } close $OUT or die $!;También puede usar php y esta fantástica biblioteca: https://github.com/parsecsv/parsecsv-for-php :
Descargue primero la biblioteca, agréguela a una nueva carpeta y agregue una copia de su archivo CSV a la carpeta (asegúrese de usar una copia, el método de guardado de esta biblioteca puede eliminar los datos de su archivo csv si no lo usa) adecuadamente) :
¡Con esta biblioteca puede analizar y modificar directamente los valores!
<?php // !!! Make a copy of your csv file before executing this // Require the Parse CSV library , that you can find there : https://github.com/parsecsv/parsecsv-for-php require_once 'parsecsv.lib.php'; // Instanciate it $csv = new parseCSV(); // Load your file $csv->auto('data.csv'); // Get the number of data rows $nb_data_rows=count($csv->data)-1; // Iterate through each data row. for ($i = 0; $i <= $nb_data_rows; $i++) { // Define the new Price $new_price=$csv->data[$i]["Price"]+125; // Format the price in order to keep two decimals $new_price=number_format($new_price, 2, '.', ''); // Modify the ith value of your csv data $csv->data[$i]=array( "Productno."=> $csv->data[$i]["Productno."], "Description."=> $csv->data[$i]["Description"], "price"=>$new_price, "Stock"=> $csv->data[$i]["Stock"], "Brand"=> $csv->data[$i]["Brand"] ); // save it ! $csv->save(); }