Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

152
Views
Cómo proporcionar una implementación de memcpy

Estoy tratando de escribir un código de metal desnudo con un bucle de estilo memset :

 for (int i = 0; i < N; ++i) { arr[i] = 0; }

Está compilado con GCC y GCC es lo suficientemente inteligente como para convertirlo en una llamada a memset() . Desafortunadamente, debido a que es bare metal, no tengo memset() (normalmente en libc), por lo que aparece un error de enlace.

 undefined reference to `memset'

Parece que la optimización que hace esta transformación es -ftree-loop-distribute-patterns :

Realice la distribución en bucle de patrones que se pueden generar en código con llamadas a una biblioteca. Este indicador está habilitado de forma predeterminada en -O2 y superior, y por -fprofile-use y -fauto-profile .

Entonces , la solución de una persona fue simplemente bajar el nivel de optimización. No muy satisfactorio.

También encontré esta página realmente útil que explica que -ffreestanding no es suficiente para que GCC no haga esto, y básicamente no hay otra opción que proporcionar sus propias implementaciones de memcpy , memmove , memset y memcmp . Estoy feliz de hacer eso, pero ¿cómo?

¡Si solo escribo memset el compilador detectará el bucle dentro de él y lo transformará en una llamada a memset! De hecho, en el código proporcionado por el proveedor de CPU que estoy usando, encontré este comentario:

 /* // This is commented out because the assembly code that the compiler generates appears to be // wrong. The code would recursively call the memset function and eventually overruns the // stack space. void * memset(void *dest, int ch, size_t count) ...

Así que supongo que ese es el problema con el que se encontraron.

¿Cómo proporciono una implementación C de memset sin que el compilador lo optimice para llamarse a sí mismo y sin deshabilitar esa optimización?

over 4 years ago · Santiago Trujillo
2 answers
Answer question

0

Ajá, revisé el código glibc y hay un modificador inhibit_loop_to_libcall que parece que debería hacer esto. Se define así :

 /* Add the compiler optimization to inhibit loop transformation to library calls. This is used to avoid recursive calls in memset and memmove default implementations. */ #ifdef HAVE_CC_INHIBIT_LOOP_TO_LIBCALL # define inhibit_loop_to_libcall \ __attribute__ ((__optimize__ ("-fno-tree-loop-distribute-patterns"))) #else # define inhibit_loop_to_libcall #endif
over 4 years ago · Santiago Trujillo Report

0

Usted menciona en su pregunta:

Parece que la optimización que hace esta transformación es -ftree-loop-distribute-patterns

todo lo que necesita hacer para desactivar esta optimización es pasar -fno-tree-loop-distribute-patterns al compilador. Esto desactiva la optimización globalmente.

over 4 years ago · Santiago Trujillo Report
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!