Tengo un archivo javascript que usa getUserMedia() para obtener el audio y el video de la computadora del cliente. ¿Cómo implemento la visión por computadora en la fuente de video que se extrajo de la cámara usando javascript getUserMedia() y el reconocimiento de voz en la fuente de audio que se extrajo del micrófono usando javascript getUserMedia() usando python?
¿Por qué quiero usar Python?
Quiero usar python porque ya he escrito todo el código para ejecutar esto localmente en mi máquina, usando matraz pero para ejecutarlo en otras computadoras tengo que usar javascript para acceder al micrófono y la cámara del cliente y no puedo usar python para hacer eso o python detectaría un micrófono y una cámara en el servidor en lugar de la máquina del cliente.
Intento #1
Intenté usar js2py para traducir un archivo .js a un archivo .py usando:
js2py.translate_file(static/sketch.js', 'sketch.py') from sketch import sketch # I use getUserMedia() function after that from the .py file Recibí un error que descubrí que era un error de archivo .js demasiado grande.
Intento #2
Miré los artículos de documentos de MDN :
https://developer.mozilla.org/en-US/docs/Web/Guide/AJAX
https://developer.mozilla.org/en-US/docs/Web/API/XMLHttpRequest
https://developer.mozilla.org/en-US/docs/Learn/JavaScript/Client-side_web_APIs/Fetching_data
Estaba realmente confundido acerca de cómo usar Ajax, así que ni siquiera lo intenté porque no sabía qué hacer. Me inclino mucho a pensar que esto podría resolver mi problema, pero podría estar equivocado, por eso hago esta pregunta.
Mi pregunta es ¿cómo entregar datos de audio/video desde el navegador de un usuario a un servidor?