| { | |
| "input_patch_len": 32, | |
| "input_transform": "identity", | |
| "linear_detrending_threshold": 0.5, | |
| "output_patch_len": 64, | |
| "quantiles": [ | |
| 0.1, | |
| 0.2, | |
| 0.3, | |
| 0.4, | |
| 0.5, | |
| 0.6, | |
| 0.7, | |
| 0.8, | |
| 0.9 | |
| ], | |
| "residual_block_config": { | |
| "activation": "relu", | |
| "dropout": 0.0, | |
| "hidden_dims": 1280, | |
| "identity_skip": false, | |
| "output_dims": 1280, | |
| "prenorm": "none", | |
| "use_bias": false | |
| }, | |
| "transformer_config": { | |
| "num_layers": 20, | |
| "transformer": { | |
| "attention_norm": "rms", | |
| "causal_attention": true, | |
| "debug_no_masking": false, | |
| "deterministic": true, | |
| "feedforward_norm": "rms", | |
| "ff_activation": "relu", | |
| "hidden_dims": 1280, | |
| "max_variates": 32, | |
| "model_dims": 1280, | |
| "num_heads": 16, | |
| "paired_token_skip_second": false, | |
| "qk_norm": "rms", | |
| "training": true, | |
| "use_bias": false, | |
| "use_memory_efficient_attention": true, | |
| "use_rope_seq": true, | |
| "use_rope_var": false, | |
| "use_sdpa": true, | |
| "v_norm": "none" | |
| }, | |
| "use_remat": true | |
| }, | |
| "use_frozen_running_stats": false, | |
| "use_iterative_cpm_revin": true, | |
| "use_linear_detrending": true, | |
| "use_stitching": true, | |
| "use_variate_attention": true, | |
| "value_clip": 1e+20 | |
| } |