Estoy tratando de escribir un código de metal desnudo con un bucle de estilo memset :
for (int i = 0; i < N; ++i) { arr[i] = 0; } Está compilado con GCC y GCC es lo suficientemente inteligente como para convertirlo en una llamada a memset() . Desafortunadamente, debido a que es bare metal, no tengo memset() (normalmente en libc), por lo que aparece un error de enlace.
undefined reference to `memset' Parece que la optimización que hace esta transformación es -ftree-loop-distribute-patterns :
Realice la distribución en bucle de patrones que se pueden generar en código con llamadas a una biblioteca. Este indicador está habilitado de forma predeterminada en -O2 y superior, y por
-fprofile-usey-fauto-profile.
Entonces , la solución de una persona fue simplemente bajar el nivel de optimización. No muy satisfactorio.
También encontré esta página realmente útil que explica que -ffreestanding no es suficiente para que GCC no haga esto, y básicamente no hay otra opción que proporcionar sus propias implementaciones de memcpy , memmove , memset y memcmp . Estoy feliz de hacer eso, pero ¿cómo?
¡Si solo escribo memset el compilador detectará el bucle dentro de él y lo transformará en una llamada a memset! De hecho, en el código proporcionado por el proveedor de CPU que estoy usando, encontré este comentario:
/* // This is commented out because the assembly code that the compiler generates appears to be // wrong. The code would recursively call the memset function and eventually overruns the // stack space. void * memset(void *dest, int ch, size_t count) ...Así que supongo que ese es el problema con el que se encontraron.
¿Cómo proporciono una implementación C de memset sin que el compilador lo optimice para llamarse a sí mismo y sin deshabilitar esa optimización?
Ajá, revisé el código glibc y hay un modificador inhibit_loop_to_libcall que parece que debería hacer esto. Se define así :
/* Add the compiler optimization to inhibit loop transformation to library calls. This is used to avoid recursive calls in memset and memmove default implementations. */ #ifdef HAVE_CC_INHIBIT_LOOP_TO_LIBCALL # define inhibit_loop_to_libcall \ __attribute__ ((__optimize__ ("-fno-tree-loop-distribute-patterns"))) #else # define inhibit_loop_to_libcall #endifUsted menciona en su pregunta:
Parece que la optimización que hace esta transformación es
-ftree-loop-distribute-patterns
todo lo que necesita hacer para desactivar esta optimización es pasar -fno-tree-loop-distribute-patterns al compilador. Esto desactiva la optimización globalmente.