# ############################################################################ # Model: SENSE multilingual semantic speech encoder # ############################################################################ # Audio configuration sample_rate: 16000 # Hugging Face repository containing the pretrained SENSE checkpoints pretrained_path: LIA-AvignonUniversity/SENSE # --------------------------------------------------------------------------- # Audio normalization # --------------------------------------------------------------------------- audio_normalizer: !new:speechbrain.dataio.preprocess.AudioNormalizer sample_rate: !ref # --------------------------------------------------------------------------- # Speech encoder: w2v-BERT 2.0 # --------------------------------------------------------------------------- wav2vec2_hub: facebook/w2v-bert-2.0 wav2vec2: !new:speechbrain.integrations.huggingface.w2v_bert.W2VBert source: !ref save_path: wav2vec2_checkpoints freeze: True sample_rate: !ref # --------------------------------------------------------------------------- # Utterance-level attention pooling # --------------------------------------------------------------------------- d_model: 1024 attn_pooling: !new:speechbrain.nnet.pooling.AttentionPooling input_dim: !ref # --------------------------------------------------------------------------- # Attention pooling module stored in model.ckpt # --------------------------------------------------------------------------- model: !new:torch.nn.ModuleList modules: - !ref # --------------------------------------------------------------------------- # Modules exposed to SENSEEncoder # --------------------------------------------------------------------------- modules: wav2vec2: !ref attn_pooling: !ref # --------------------------------------------------------------------------- # Pretrained checkpoint loading # --------------------------------------------------------------------------- pretrainer: !new:speechbrain.utils.parameter_transfer.Pretrainer loadables: wav2vec2: !ref model: !ref paths: wav2vec2: !ref /wav2vec2.ckpt model: !ref /model.ckpt