| { |
| "container": "trained_susv_wave_gamma_chunked_v1", |
| "decode_entry": "decode_expert_layer_v3t / decode_expert_v3t (decode.py)", |
| "fields": "trellis|su|sv|wave_gamma", |
| "susv_mode": "continuous fp16, Wscale absorbed in sv (replaces int8 +-1 signs)", |
| "wave_gamma": { |
| "len": "Mb+Nb (transpose-invariant; 160 at 512x2048 pads)", |
| "index": "wave_index_map(Mb,Nb) in decode.py \u2014 LAST wavefront that wrote each tile", |
| "granularity": "constant per 16x16 tile; constant along each encoder wavefront" |
| }, |
| "op_order": "recons -> fp16 cast -> wave_gamma (BEFORE both Hadamards) -> H_n -> *su -> T -> H_m -> *sv -> T -> crop", |
| "tlut": { |
| "file": "packed/experts/codebook.safetensors", |
| "structure": "exact scaled integer lattice: global_scale * levels", |
| "global_scale": 0.8963924050331116, |
| "integer_levels": [ |
| -5, |
| -4, |
| -3, |
| -2, |
| -1, |
| 0, |
| 1, |
| 2, |
| 3, |
| 4 |
| ], |
| "n_levels": 10, |
| "ratios_exactly_integer": true |
| }, |
| "kernel_contract": { |
| "adds": "per-weight ops remain 100% add/subtract on the exact lattice (codes + tlut unchanged)", |
| "stage_1_wave_gamma": "scale each 16x16 tile's partial sums by gamma[wave(tile)] (fp16) BEFORE cross-tile accumulation; ~1 multiply per 16 weights", |
| "stage_2_susv": "un-rotation sign-flips become per-dim fp16 multiplies (su over n, sv over m); n+m mults/GEMV", |
| "gate_guidance": "codebook-only lattice gates MUST also key on this file's container field" |
| }, |
| "cb_params": { |
| "K": 1.5, |
| "L": 16, |
| "V": 8, |
| "tlut_bits": 15, |
| "decode_mode": "quantlut_sym", |
| "td_x": 16, |
| "td_y": 16 |
| }, |
| "ne_tier": { |
| "live_set": "packed/ne/L00-L39.safetensors (zero-padded, all layers)", |
| "codec": "canon_rht_bitshift_trellis_intlattice", |
| "cb_params": { |
| "K": 4, |
| "L": 16, |
| "V": 2, |
| "tlut_bits": 9, |
| "decode_mode": "quantlut_sym", |
| "td_x": 16, |
| "td_y": 16 |
| }, |
| "keys": "<tensor>|{trellis,SU,SV,Wscale} (int8 sign SU/SV + scalar fp16 Wscale)", |
| "metadata": "per-file: codec + cb_params + dims \u2014 NO manifest key", |
| "tlut": { |
| "file": "packed/ne/tlut.safetensors", |
| "shape": [ |
| 512, |
| 2 |
| ], |
| "sha256_16": "41a6b4f5ae0ca5ab" |
| }, |
| "decode_entry": "decode_ne_shard (decode.py; dispatches on codec metadata)" |
| }, |
| "head_tier": { |
| "files": "packed/head/head_c{0..7}of8.safetensors", |
| "codec": "int5g64_packed", |
| "keys": "LMHEADCHUNK:{r0}:{r1}|{qp,gscale} (+ optional |prot_rows,|prot_dense)", |
| "decode_entry": "decode_head (decode.py)" |
| }, |
| "embed_tier": { |
| "file": "packed/ne/embed_int4.safetensors", |
| "format": "affine int4 asym g64 + exact-overwrite exceptions (encoder-GPU FMA boundary elements)", |
| "keys": "q_packed|mn|mx|exc_idx|exc_bits", |
| "decode_entry": "decode_embed(packed_dir, bits=4) (decode.py, pure numpy)" |
| } |
| } |