Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

225
Vistas
Texto especial a caracteres latinos en python.

Tengo el siguiente marco de datos de pandas:

 the_df = pd.DataFrame({'id':[1,2],'name':['Joe','𝒮𝒶𝓇𝒶𝒽']}) the_df id name 0 1 Joe 1 2 𝒮𝒶𝓇𝒶𝒽

Como puede ver, podemos leer el segundo nombre como "Sarah", pero está escrito con caracteres especiales.

Quiero crear una nueva columna con estos caracteres convertidos a caracteres latinos. He probado este enfoque:

 the_df['latin_name'] = the_df['name'].str.extract(r'(^[a-zA-Z\s]*)') the_df id name latin_name 0 1 Joe Joe 1 2 𝒮𝒶𝓇𝒶𝒽

Pero no reconoce las letras. Por favor, cualquier ayuda en esto será muy apreciada.

over 4 years ago · Santiago Trujillo
2 Respuestas
Responde la pregunta

0

Prueba .str.normalize

 the_df['name'].str.normalize('NFKC').str.extract(r'(^[a-zA-Z\s]*)')

Producción:

 0 0 Joe 1 Sarah
over 4 years ago · Santiago Trujillo Denunciar

0

Puedes usar unicodedata.normalize :

 >>> import unicodedata >>> df['name'].apply(lambda x: unicodedata.normalize('NFKD', x)) 0 Joe 1 Sarah Name: name, dtype: object
over 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda