Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

581
Views
Grabación de audio de Google Colab, cómo implementar una forma más precisa de decirles a los usuarios que comiencen a hablar en el micrófono

Estoy tratando de crear un programa que grabará audio para un proyecto de aprendizaje automático y quiero usar Google Colab para que las personas no tengan que instalar o ejecutar nada en su sistema. Encontré este ejemplo en línea que graba y reproduce audio. :

la celda 1 contiene el código js para grabar audio y el código python para convertirlo en un objeto de bytes:

 # all imports from io import BytesIO from base64 import b64decode from google.colab import output from IPython.display import Javascript RECORD = """ const sleep = time => new Promise(resolve => setTimeout(resolve, time)) const b2text = blob => new Promise(resolve => { const reader = new FileReader() reader.onloadend = e => resolve(e.srcElement.result) reader.readAsDataURL(blob) }) var record = time => new Promise(async resolve => { stream = await navigator.mediaDevices.getUserMedia({ audio: true }) recorder = new MediaRecorder(stream) chunks = [] recorder.ondataavailable = e => chunks.push(e.data) recorder.start() await sleep(time) recorder.onstop = async ()=>{ blob = new Blob(chunks) text = await b2text(blob) resolve(text) } recorder.stop() }) """ def record(sec=3): print("") print("Speak Now...") display(Javascript(RECORD)) sec += 1 s = output.eval_js('record(%d)' % (sec*1000)) print("Done Recording !") b = b64decode(s.split(',')[1]) return b #byte stream

la celda 2 ejecuta las funciones de grabación:

 audio = record(2)

la celda 3 crea un elemento de visualización para que pueda reproducir la grabación:

 import IPython.display as ipd ipd.display(ipd.Audio(audio))

Al final, haré que los usuarios hablen una palabra durante 1 segundo, y el problema con el que me encuentro es que hay una discrepancia entre cuando se le dice al usuario que hable y cuando comienza la grabación real, si hablo de inmediato al principio. de mi discurso no está en el archivo de audio. ¿Hay alguna manera de alinear con mayor precisión cuando aparece el comando para hablar y cuando comienza la grabación real?

about 4 years ago · Juan Pablo Isaza
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!