hnluo
2023-09-11 9fcb3cc06b4e324f0913d2f61b89becc2baeef1b
egs_modelscope/asr/paraformer/speech_paraformer-large-contextual_asr_nat-zh-cn-16k-common-vocab8404/finetune.py
@@ -14,6 +14,7 @@
    ds_dict = MsDataset.load(params.data_path)
    kwargs = dict(
        model=params.model,
        model_revision="v1.0.2",
        data_dir=ds_dict,
        dataset_type=params.dataset_type,
        work_dir=params.output_dir,
@@ -28,8 +29,8 @@
    params = modelscope_args(model="damo/speech_paraformer-large-contextual_asr_nat-zh-cn-16k-common-vocab8404", data_path="./data")
    params.output_dir = "./checkpoint"              # 模型保存路径
    params.data_path = "./example_data/"            # 数据路径
    params.dataset_type = "large"                   # finetune contextual paraformer模型只能使用large dataset
    params.batch_bins = 200000                      # batch size,如果dataset_type="small",batch_bins单位为fbank特征帧数,如果dataset_type="large",batch_bins单位为毫秒,
    params.dataset_type = "large"                   # finetune contextual_paraformer模型只能使用large dataset
    params.batch_bins = 120000                      # batch size,如果dataset_type="small",batch_bins单位为fbank特征帧数,如果dataset_type="large",batch_bins单位为毫秒,
    params.max_epoch = 20                           # 最大训练轮数
    params.lr = 0.0002                              # 设置学习率