aai_practice3 / asr_transcription.py
itsmariamaraki's picture
Rename asr_transcription.ipynb to asr_transcription.py
4e35631
Raw
History Blame
450 Bytes
import gradio as gr
from transformers import pipeline
import numpy as np
transcriber = pipeline('automatic-speech-recognition', model='openai/whisper-base')
def transcribe(audio):
sr, y = audio
y = y.astype(np.float32)
y /= np.max(np.abs(y))
return transcriber({'sampling_rate': sr, 'raw': y})['text']
demo = gr.Interface(
fn = transcribe,
inputs = gr.Audio(sources=['microphone']),
outputs = 'text',
)
demo.launch()