Estoy leyendo un archivo csv en node.js que contiene direcciones URL, quiero poder detectar cuándo una cadena contiene este carácter, o cualquier otro carácter que no sea el símbolo UTF8 adecuado.
URL incorrecta que quiero poder detectar:
'https://example.com/v�hicules-de-location/france'URL correcta que quiero ignorar
'https://example.com/véhicules-de-location/france'¿Hay una manera fácil con JavaScript para hacer eso?
El archivo viene con el � ya allí, puedo verlo cuando lo abro con un editor de texto, ya está allí una vez que el � está allí, no se puede hacer nada para codificarlo correctamente.
Al final estoy haciendo esto, porque el personaje 'corrupto' ya viene así y no es algo que pueda controlar.
.... import csv from 'csv-parser' import { Readable } from 'stream' export default async (buffer) => { const json = [] return new Promise((resolve, reject) => { Readable.from(buffer) .pipe(csv()) .on('data', (data) => { const corrupted = Object.values(data).some((entry) => /�/.test(entry)) if (corrupted) reject('encoding') json.push(data) }) .on('end', async () => { resolve(writeFile ....) }) }) }