num_blocks: 12 embedding_dim: 512 input_patch_size: 32 output_patch_size: 32 input_ff_dim: 2048 h_expand: 4 context_len: 2048 future_len: 320 dropout: 0.1 quantiles: - 0.1 - 0.2 - 0.3 - 0.4 - 0.5 - 0.6 - 0.7 - 0.8 - 0.9 act_func: torch.nn.SiLU use_qk_norm: true tokenizer_cfg: input_patch_size: 32 output_patch_size: 32 input_patch_stride: 32 scaler_cfg: use_arcsinh: true binaryaware: true stack_out_norm_config: eps: 1.0e-07 tta_diff: true stack_config: templates: slstm_attn: time_mixer: model_type: bi-slstm embedding_dim: 512 num_heads: 4 rnn_backend: flashrnn-cuda num_slstm_heads: 4 variate_mixer: embedding_dim: 512 num_heads: 4 dropout: 0.1 eps: 1.0e-07 mlstm_attn: time_mixer: model_type: bi-mlstm embedding_dim: 512 num_heads: 4 rnn_backend: flashrnn-cuda variate_mixer: embedding_dim: 512 num_heads: 4 dropout: 0.1 eps: 1.0e-07 recipe: - mlstm_attn - slstm_attn - mlstm_attn - slstm_attn - mlstm_attn - slstm_attn - mlstm_attn - slstm_attn - mlstm_attn - slstm_attn - mlstm_attn - slstm_attn