defaults:-default-_self__target_:meds_torch.models.components.transformer_decoder.TransformerDecoderModel.initializemodel:_target_:x_transformers.TransformerWrappernum_tokens:${data.vocab_size}max_seq_len:${model.max_seq_len}emb_dropout:${model.backbone.dropout}use_abs_pos_emb:falseattn_layers:_target_:x_transformers.Decoderdim:${model.token_dim}depth:${model.backbone.n_layers}heads:${model.backbone.nheads}layer_dropout:${model.backbone.dropout}# stochastic depth - dropout entire layerattn_dropout:${model.backbone.dropout}# dropout post-attentionff_dropout:${model.backbone.dropout}# feedforward dropoutrotary_pos_emb:trueattn_flash:Truetoken_emb:null# use x-transformers to embed tokensmax_seq_len:${model.max_seq_len}# is the sampling temperature, `0` corresponds to greedy samplingeos_token_id:null# stop sampling when this token is generated