quiero hacer algo como
if ($2 in another file) { print $0 }Digamos que tengo el archivo A.txt que contiene
aa bb ccTengo B.txt como
00,aa 11,bb 00,ddquiero imprimir
00,aa 11,bb¿Cómo pruebo eso en awk? No estoy familiarizado con los trucos de procesar dos archivos a la vez.
Podrías usar algo como esto:
awk -F, 'NR == FNR { a[$0]; next } $2 in a' A.txt B.txt Esto guarda cada línea de A.txt como una clave en la matriz a y luego imprime cualquier línea de B.txt cuyo segundo campo esté en la matriz.
NR == FNR es la forma estándar de apuntar al primer archivo pasado a awk, ya que NR (el número de registro total) solo es igual a FNR (el número de registro del archivo actual) para el primer archivo. next salta al siguiente registro, por lo que los $2 in a parte nunca se alcanzan hasta el segundo archivo.
alternativa con join
si los archivos están ordenados en el campo unido
$ join -t, -1 1 -2 2 -o2.1,2.2 file1 file2 00,aa 11,bb establece el delimitador en coma, une el primer campo del primer archivo con el segundo campo del segundo archivo, los campos de salida se intercambian. Si no está ordenado, debe ordenarlos primero, pero entonces awk podría ser una mejor opción.
Parece que hay dos escuelas de pensamiento al respecto. Algunos prefieren usar el idioma basado en BEGIN y otros el idioma basado en FNR.
Aquí está la esencia de la primera:
awk -v infile=INFILE ' BEGIN { while( (getline < infile)>0 ) { .... } } ... 'Para esto último, solo busca:
awk 'FNR==NR'