sanjitaa commited on
Commit
49e5bfc
·
1 Parent(s): 679e261

update app.py

Browse files
Files changed (1) hide show
  1. app.py +7 -4
app.py CHANGED
@@ -33,19 +33,22 @@ def translate(inputs, task):
33
 
34
  #text = pipe(inputs, batch_size=BATCH_SIZE, generate_kwargs={"task": task}, return_timestamps=True)["text"]
35
  ts_model = WhisperModel(MODEL_NAME, device = device, compute_type = "int8")
36
- text = ts_model.transcribe(inputs, task = "translate")
 
 
 
37
 
38
- encoded_text = tokenizer(text, return_tensors="pt")
39
  tokenizer.src_lang = "en_XX"
40
 
41
  generated_tokens = model.generate(
42
  **encoded_text,
43
  forced_bos_token_id=tokenizer.lang_code_to_id["fr_XX"]
44
  )
 
45
  result = tokenizer.batch_decode(generated_tokens, skip_special_tokens=True)
46
  return result
47
-
48
-
49
  demo = gr.Blocks()
50
 
51
  mf_transcribe = gr.Interface(
 
33
 
34
  #text = pipe(inputs, batch_size=BATCH_SIZE, generate_kwargs={"task": task}, return_timestamps=True)["text"]
35
  ts_model = WhisperModel(MODEL_NAME, device = device, compute_type = "int8")
36
+ segments, _ = ts_model.transcribe(inputs, task = "translate")
37
+ lst = ''
38
+ for segment in segments:
39
+ lst = lst + segment.text
40
 
41
+ encoded_text = tokenizer(lst, return_tensors="pt")
42
  tokenizer.src_lang = "en_XX"
43
 
44
  generated_tokens = model.generate(
45
  **encoded_text,
46
  forced_bos_token_id=tokenizer.lang_code_to_id["fr_XX"]
47
  )
48
+
49
  result = tokenizer.batch_decode(generated_tokens, skip_special_tokens=True)
50
  return result
51
+
 
52
  demo = gr.Blocks()
53
 
54
  mf_transcribe = gr.Interface(