Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

226
Views
Texto especial a caracteres latinos en python.

Tengo el siguiente marco de datos de pandas:

 the_df = pd.DataFrame({'id':[1,2],'name':['Joe','๐’ฎ๐’ถ๐“‡๐’ถ๐’ฝ']}) the_df id name 0 1 Joe 1 2 ๐’ฎ๐’ถ๐“‡๐’ถ๐’ฝ

Como puede ver, podemos leer el segundo nombre como "Sarah", pero estรก escrito con caracteres especiales.

Quiero crear una nueva columna con estos caracteres convertidos a caracteres latinos. He probado este enfoque:

 the_df['latin_name'] = the_df['name'].str.extract(r'(^[a-zA-Z\s]*)') the_df id name latin_name 0 1 Joe Joe 1 2 ๐’ฎ๐’ถ๐“‡๐’ถ๐’ฝ

Pero no reconoce las letras. Por favor, cualquier ayuda en esto serรก muy apreciada.

over 4 years ago ยท Santiago Trujillo
2 answers
Answer question

0

Prueba .str.normalize

 the_df['name'].str.normalize('NFKC').str.extract(r'(^[a-zA-Z\s]*)')

Producciรณn:

 0 0 Joe 1 Sarah
over 4 years ago ยท Santiago Trujillo Report

0

Puedes usar unicodedata.normalize :

 >>> import unicodedata >>> df['name'].apply(lambda x: unicodedata.normalize('NFKD', x)) 0 Joe 1 Sarah Name: name, dtype: object
over 4 years ago ยท Santiago Trujillo Report
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
ยฉ 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!