Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

306
Vistas
Cómo agregar espacios faltantes después de períodos usando expresiones regulares, sin cambiar decimales

Tengo un texto grande al que le faltan espacios después de algunos de los puntos. Sin embargo, el texto también contiene números decimales.

Esto es lo que tengo hasta ahora para solucionar el problema usando expresiones regulares (estoy usando python):

re.sub(r"(?!\d\.\d)(?!\. )\.", '. ', my_string)

Pero el primer grupo de escape no parece funcionar. Todavía coincide con períodos en números decimales.

Aquí hay un texto de muestra para asegurarse de que cualquier posible solución funcione:

 this is a.match this should also match.1234 and this should 123.match this should NOT match. Has space after period this also should NOT match 1.23
over 4 years ago · Santiago Trujillo
3 Respuestas
Responde la pregunta

0

Puedes usar

 re.sub(r'\.(?!(?<=\d\.)\d) ?', '. ', text)

Vea la demostración de expresiones regulares . El espacio final se empareja opcionalmente, por lo que si está allí, se eliminará y se volverá a colocar.

Detalles

  • \. - un punto
  • (?!(?<=\d\.)\d) - no coincidan más si el punto anterior era un punto entre dos dígitos
  • ? - un espacio opcional.

Vea una demostración de Python :

 import re text = "this is a.match\nthis should also match.1234\nand this should 123.match\n\nthis should NOT match. Has space after period\nthis also should NOT match 1.23" print(re.sub(r'\.(?!(?<=\d\.)\d) ?', '. ', text))

Producción:

 this is a. match this should also match. 1234 and this should 123. match this should NOT match. Has space after period this also should NOT match 1.23

Alternativamente, use una anticipación (?! ) como en su intento:

 re.sub(r'\.(?!(?<=\d\.)\d)(?! )', '. ', text)

Vea la demostración de expresiones regulares y la demostración de Python .

over 4 years ago · Santiago Trujillo Denunciar

0

Otra forma... no estoy seguro de si esto es mejor o peor para el rendimiento que la solución de Wiktor.

 re.sub(r"(?!\d\.\d)(?!.\. )(.\.)(.)", r"\1 \2", my_string)
over 4 years ago · Santiago Trujillo Denunciar

0

txt="hello world.this is boise idaho.a this is twin falls." pattern=r"(\w+\s*\.\w+)+" matches=re.findall(pattern,txt) for item in matches: front,back=item.split('.') replace=front+'. '+back txt=re.sub(item,replace,txt) print(txt) hello world. this is boise idaho. a this is twin falls.
over 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda