Estoy tratando de acceder a las primeras líneas de archivos de texto usando FileApi en JavaScript.
Para hacerlo, divido un número arbitrario de bytes desde el principio del archivo y entrego el blob al FileReader .
Para archivos grandes, esto lleva mucho tiempo, aunque, según tengo entendido, actualmente solo es necesario acceder a los primeros bytes del archivo.
Actualmente he probado tanto en Chrome como en Edge (cromo).
El análisis en Chrome utilizando las herramientas de desarrollo de rendimiento muestra mucho tiempo de inactividad antes del final de carga del reader.onloadend y ningún aumento en el uso de RAM. Sin embargo, esto podría deberse a que FileApi se implementa en el navegador y no se refleja en las estadísticas de rendimiento de JavaScript.
Mi implementación de FileReader se parece a esto:
const reader = new FileReader(); reader.onloadend = (evt) => { if (evt.target.readyState == FileReader.DONE) { console.log(evt.target.result.toString()); } }; // Slice first 10240 bytes of the file var blob = files.item(0).slice(0, 1024 * 10); // Start reading the sliced blob reader.readAsBinaryString(blob);Esto funciona bien pero, como se describe, funciona bastante mal para archivos grandes . Lo probé para 10kb, 100mb y 6gb. El tiempo hasta que se registran los primeros 10 kb parece estar directamente relacionado con el tamaño del archivo.
¿Alguna sugerencia sobre cómo mejorar el rendimiento para leer el principio de un archivo?
Editar: Lamentablemente, el uso de flujos de Respuesta y DOM como lo sugiere @BenjaminGruenbaum no mejora el rendimiento de lectura.
var dest = newWritableStream({ write(str) { console.log(str); }, }); var blob = files.item(0).slice(0, 1024 * 10); (blob.stream ? blob.stream() : newResponse(blob).body) // Decode the binary-encoded response to string .pipeThrough(newTextDecoderStream()) .pipeTo(dest) .then(() => { console.log('done'); });