Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

421
Vistas
¿Por qué wprintf translitera el texto ruso en Unicode al latín en Linux?

¿Por qué el siguiente programa

 #include <stdio.h> #include <wchar.h> int main() { wprintf(L"Привет, мир!"); }

imprimir "Ligustro, mir!" en Linux? Específicamente, ¿por qué translitera el texto ruso en Unicode al latín en lugar de transcodificarlo a UTF-8 o usar caracteres de reemplazo?

Demostración de este comportamiento en Godbolt: https://godbolt.org/z/36zEcG

La versión no ancha printf("Привет, мир!") imprime este texto como se esperaba ("Привет, мир!").

over 4 years ago · Santiago Trujillo
2 Respuestas
Responde la pregunta

0

Porque la conversión de caracteres anchos se realiza de acuerdo con la configuración regional actual. De forma predeterminada, un programa C siempre comienza con una configuración regional "C" que solo admite caracteres ASCII.

Primero debe cambiar a cualquier configuración regional rusa o UTF-8:

 setlocale(LC_ALL, "ru_RU.utf8"); // Russian Unicode setlocale(LC_ALL, "en_US.utf8"); // English US Unicode

O a una configuración regional del sistema actual (que es probablemente lo que necesita):

 setlocale(LC_ALL, "");

El programa completo será:

 #include <stdio.h> #include <wchar.h> #include <locale.h> int main() { setlocale(LC_ALL, "ru_RU.utf8"); wprintf(L"Привет, мир!\n"); }

En cuanto a que su código funcione tal como está en otras máquinas, esto se debe a cómo funciona libc allí. Algunas implementaciones (como musl) no admiten entornos locales que no sean Unicode y, por lo tanto, pueden traducir incondicionalmente caracteres anchos a una secuencia UTF-8.

over 4 years ago · Santiago Trujillo Denunciar

0

¿Por qué translitera el texto ruso en Unicode al latín en lugar de transcodificarlo a UTF-8 o usar caracteres de reemplazo?

Porque la configuración regional inicial de su programa es la predeterminada, la configuración regional C Entonces está traduciendo una cadena ancha a la configuración regional C C locale no maneja UTF-8 ni Unicode, por lo que su biblioteca estándar hace lo mejor para traducir caracteres anchos en algún conjunto de caracteres básico utilizado en C locale.

Puede cambiar la configuración regional a cualquier configuración regional UTF-8 y el programa debe generar una cadena UTF-8.

Nota: (en la implementación que conozco) la codificación del flujo de FILE se determina y se guarda en el momento en que se elige la orientación del flujo (ancho frente a normal). Recuerde establecer la configuración regional antes de hacer algo con stdout (es decir, esto frente a esto ).

over 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda