Actualmente estoy buscando una forma de extraer el código (PostScript) detrás de un PDF solo de sus datos binarios. Tengo una entrada de archivo de tipo que tiene un controlador de eventos onChange adjunto. El controlador de eventos se ve así:
const handleFileChange = (e) => { const [file] = e.target.files const reader = new FileReader() reader.addEventListener("loadend", () => { const buffer = reader.result const view = new DataView(buffer) const decoder = new TextDecoder("ascii") const text = decoder.decode(view) }) reader.readAsArrayBuffer(file) } Este código produce un texto similar a este %PDF-1.3 %Äåòåë§ó ÐÄÆ 3 0 obj << /Filter /FlateDecode /Length 4573 >> stream xµ\ëŽÜ¶þϧ жVwi‚ hìM El comienzo está bien, es todo después es el problema - %Äåòåë§ó ÐÄÆ & µ\ëŽÜ¶þϧ жVwi‚ hìM . es ilegible No estoy seguro de si he seleccionado la codificación incorrecta o si lo que me propongo es casi imposible. ¿Me estoy perdiendo de algo? Si es así, ¿qué exactamente? Agradezco cualquier y toda ayuda. ¡Gracias!
( los recursos también son bienvenidos )