雾聪
2023-10-23 bbcf0d87ace59ec238ec757ea19ec0dd2883e94a
funasr/bin/asr_infer.py
@@ -1922,9 +1922,6 @@
    ):
        from funasr.tasks.whisper import ASRTask
        from funasr.utils.whisper_utils.transcribe import transcribe
        from funasr.utils.whisper_utils.audio import pad_or_trim, log_mel_spectrogram
        from funasr.utils.whisper_utils.decoding import DecodingOptions, detect_language, decode
        # 1. Build ASR model
        scorers = {}
@@ -1987,6 +1984,10 @@
        """
        from funasr.utils.whisper_utils.transcribe import transcribe
        from funasr.utils.whisper_utils.audio import pad_or_trim, log_mel_spectrogram
        from funasr.utils.whisper_utils.decoding import DecodingOptions, detect_language, decode
        speech = speech[0]
        speech = pad_or_trim(speech)
        mel = log_mel_spectrogram(speech).to(self.device)