| { |
| "vocab_size": 8000, |
| "block_size": 384, |
| "n_layer": 8, |
| "n_head": 7, |
| "n_embd": 448, |
| "dropout": 0.2, |
| "tokenizer_type": "sentencepiece_bpe", |
| "tokenizer_file": "MTP2_9_tokenizer.model", |
| "special_tokens": { |
| "pad_id": 0, |
| "bos_id": 1, |
| "eos_id": 2, |
| "unk_id": 3 |
| }, |
| "generation_defaults": { |
| "max_new_tokens": 200, |
| "temperature": 0.8, |
| "top_k": 40, |
| "top_p": 0.9, |
| "repetition_penalty": 1.2, |
| "no_repeat_ngram_size": 3 |
| }, |
| "meta": { |
| "model_name": "MTP-2.9", |
| "architecture": "gpt_rope_swiglu_rmsnorm", |
| "trained_examples": 7136, |
| "augmented_examples": 21512, |
| "corpus_fragments": 318, |
| "total_sequences": 21864, |
| "best_val_loss": 2.4462781286239625, |
| "stopped_early": false, |
| "label_smoothing": 0.1, |
| "created": "2026-07-15 07:09:14" |
| } |
| } |