Empresas
Empregos
  • Sobre nós
  • Soluções
    • Publicação de vagas
      Publique sua vaga e receba candidatos qualificados em 48h.
    • Avaliações de candidatos
      Mais de 500 testes técnicos e psicológicos, mais anti-fraude.
    • Headhunting
      Busca executiva personalizada do início ao fim.
    • Folha de Pagamento + EOR
      Dispersão de folha e EOR em mais de 15 países da LATAM.
  • Preços
  • Empregos

0

598
Visualizações
Grabación de audio de Google Colab, cómo implementar una forma más precisa de decirles a los usuarios que comiencen a hablar en el micrófono

Estoy tratando de crear un programa que grabará audio para un proyecto de aprendizaje automático y quiero usar Google Colab para que las personas no tengan que instalar o ejecutar nada en su sistema. Encontré este ejemplo en línea que graba y reproduce audio. :

la celda 1 contiene el código js para grabar audio y el código python para convertirlo en un objeto de bytes:

 # all imports from io import BytesIO from base64 import b64decode from google.colab import output from IPython.display import Javascript RECORD = """ const sleep = time => new Promise(resolve => setTimeout(resolve, time)) const b2text = blob => new Promise(resolve => { const reader = new FileReader() reader.onloadend = e => resolve(e.srcElement.result) reader.readAsDataURL(blob) }) var record = time => new Promise(async resolve => { stream = await navigator.mediaDevices.getUserMedia({ audio: true }) recorder = new MediaRecorder(stream) chunks = [] recorder.ondataavailable = e => chunks.push(e.data) recorder.start() await sleep(time) recorder.onstop = async ()=>{ blob = new Blob(chunks) text = await b2text(blob) resolve(text) } recorder.stop() }) """ def record(sec=3): print("") print("Speak Now...") display(Javascript(RECORD)) sec += 1 s = output.eval_js('record(%d)' % (sec*1000)) print("Done Recording !") b = b64decode(s.split(',')[1]) return b #byte stream

la celda 2 ejecuta las funciones de grabación:

 audio = record(2)

la celda 3 crea un elemento de visualización para que pueda reproducir la grabación:

 import IPython.display as ipd ipd.display(ipd.Audio(audio))

Al final, haré que los usuarios hablen una palabra durante 1 segundo, y el problema con el que me encuentro es que hay una discrepancia entre cuando se le dice al usuario que hable y cuando comienza la grabación real, si hablo de inmediato al principio. de mi discurso no está en el archivo de audio. ¿Hay alguna manera de alinear con mayor precisión cuando aparece el comando para hablar y cuando comienza la grabación real?

about 4 years ago · Juan Pablo Isaza
Responde à pergunta
Encontrar trabalhos remotos

Descubra a nova forma de encontrar um emprego!

melhores empregos
Principais categorias de trabalho
Empresas
Postar vaga Preços Comercial
Jurídico
Termos e Condições Política de privacidade
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomende algumas ofertas para mim
Preciso de ajuda