defaults:-default-_self__target_:meds_torch.models.components.transformer_encoder.TransformerEncoderModel.initializemodel:_target_:x_transformers.TransformerWrapperlogits_dim:${model.token_dim}num_tokens:${data.vocab_size}max_seq_len:${model.max_seq_len}emb_dropout:${model.backbone.dropout}use_abs_pos_emb:falseattn_layers:_target_:x_transformers.Encoderdim:${model.token_dim}depth:${model.backbone.n_layers}heads:${model.backbone.nheads}layer_dropout:${model.backbone.dropout}# stochastic depth - dropout entire layerattn_dropout:${model.backbone.dropout}# dropout post-attentionff_dropout:${model.backbone.dropout}# feedforward dropoutrotary_pos_emb:trueattn_flash:Trueuse_cls_token:truetoken_emb:_target_:torch.nn.Identity# assume data is pre-embedded by the input_encoder