Quiero dividir el texto en fragmentos de una longitud de caracteres determinada.
La división debe ocurrir en el siguiente carácter de espacio en blanco después de alcanzar un recuento de caracteres específico.
Esta es mi expresión regular:
\S+.{0,14}(?= |$)Y aquí hay una entrada de muestra:
Cuando se hace correctamente, la exposición al calor ofrece enormes beneficios. Sin embargo, es extremadamente peligroso usar temperaturas demasiado altas. ¿Qué es demasiado caliente? Eso dependerá.
He preparado un ejemplo de trabajo: https://regex101.com/r/JGJvtm/3
Sin embargo, también necesito terminar un fragmento dado, cuando encuentra el final de una oración [!.?](?= |$)
Como se ve en el ejemplo: “…beneficios. Sin embargo,…” ahora se considera una porción.
La división debe ocurrir después del punto, y el siguiente fragmento debe comenzar con "Sin embargo", aunque aún no se haya alcanzado el límite de caracteres.
Siéntase libre de proponer una expresión regular completamente diferente, lo que sea que funcione.
Hay un problema con su expresión regular actual: \S+ capturará palabras potencialmente largas, y el conteo de 14 caracteres solo comienza después de esa coincidencia. De acuerdo con su descripción, también las letras de esa primera palabra deben contar para el límite.
Yo sugeriría esta expresión regular:
(?=\S)((?).){0,13}\S*
(?=\S) garantiza que la coincidencia comience con un carácter que no sea un espacio en blanco sin capturarlo todavía.(?) asegura que el siguiente carácter no sea un terminador de oración seguido de un espacio en blanco o al final de la entrada.( .){0,13} coincide con hasta 13 caracteres\S* capturará los caracteres restantes que no sean espacios en blanco.\S.{13}\S*\shttps://regex101.com/r/2g4TBr/1
comience con 1 no espacio, luego cualquier 13 caracteres, luego tome la "cola" antes del espacio