游雁
2024-06-12 2518f03d20caeb8f1707da49aacad37a2e76c06d
funasr/models/sense_voice/whisper_lib/decoding.py
@@ -63,8 +63,8 @@
    else:
        x = x.to(mel.device)
    # FIX(funasr): sense vocie
    # logits = model.logits(x[:, :-1], mel)[:, -1]
    logits = model.logits(x[:, :], mel)[:, -1]
    logits = model.logits(x[:, :-1], mel)[:, -1]
    # logits = model.logits(x[:, :], mel)[:, -1]
    # collect detected languages; suppress all non-language tokens
    mask = torch.ones(logits.shape[-1], dtype=torch.bool)