[2026-07-18 18:01:33,647][__main__][INFO] - [rank: 0] Instantiating datamodule [2026-07-18 18:01:33,662][datasets][INFO] - PyTorch version 2.8.0+cu128 available. [2026-07-18 18:01:34,447][fish_speech.tokenizer][INFO] - Loaded Tokenizer. Semantic Range: 151678 -> 155773 [2026-07-18 18:01:34,960][fish_speech.tokenizer][INFO] - Loaded Tokenizer. Semantic Range: 151678 -> 155773 [2026-07-18 18:01:35,498][fish_speech.tokenizer][INFO] - Loaded Tokenizer. Semantic Range: 151678 -> 155773 [2026-07-18 18:01:35,501][__main__][INFO] - [rank: 0] Instantiating model 2026-07-18 18:01:35.510 | INFO | fish_speech.models.text2semantic.llama:from_pretrained:493 - Override max_seq_len to 4096 [2026-07-18 18:01:36,017][fish_speech.tokenizer][INFO] - Loaded Tokenizer. Semantic Range: 151678 -> 155773 2026-07-18 18:01:36.020 | INFO | fish_speech.models.text2semantic.llama:from_pretrained:504 - Injected Semantic IDs into Config: 151678-155773 2026-07-18 18:01:36.020 | INFO | fish_speech.models.text2semantic.llama:from_pretrained:520 - Loading model from /opt/work/checkpoints/s2-pro, config: DualARModelArgs(model_type='dual_ar', vocab_size=155776, n_layer=36, n_head=32, dim=2560, intermediate_size=9728, n_local_heads=8, head_dim=128, rope_base=1000000, norm_eps=1e-06, max_seq_len=4096, dropout=0.0, tie_word_embeddings=True, attention_qkv_bias=False, attention_o_bias=False, attention_qk_norm=True, codebook_size=4096, num_codebooks=10, semantic_begin_id=151678, semantic_end_id=155773, use_gradient_checkpointing=True, initializer_range=0.01976423537605237, is_reward_model=False, scale_codebook_embeddings=True, audio_embed_dim=2560, n_fast_layer=4, fast_dim=2560, fast_n_head=32, fast_n_local_heads=8, fast_head_dim=128, fast_intermediate_size=9728, fast_attention_qkv_bias=False, fast_attention_qk_norm=False, fast_attention_o_bias=False, norm_fastlayer_input=True) 2026-07-18 18:02:13.011 | INFO | fish_speech.models.text2semantic.llama:from_pretrained:552 - Loading sharded safetensors weights 2026-07-18 18:02:14.118 | INFO | fish_speech.models.text2semantic.llama:from_pretrained:588 - Model weights loaded - Status: 2026-07-18 18:02:17.313 | INFO | fish_speech.models.text2semantic.llama:from_pretrained:592 - LoRA setup: LoraConfig(r=32, lora_alpha=16, lora_dropout=0.1, target_modules=['fast_attention', 'fast_mlp', 'fast_embeddings', 'fast_output']) [2026-07-18 18:02:17,314][__main__][INFO] - [rank: 0] Instantiating callbacks... [2026-07-18 18:02:17,314][fish_speech.utils.instantiators][INFO] - [rank: 0] Instantiating callback [2026-07-18 18:02:17,316][fish_speech.utils.instantiators][INFO] - [rank: 0] Instantiating callback [2026-07-18 18:02:17,316][fish_speech.utils.instantiators][INFO] - [rank: 0] Instantiating callback [2026-07-18 18:02:17,316][fish_speech.utils.instantiators][INFO] - [rank: 0] Instantiating callback [2026-07-18 18:02:17,317][fish_speech.utils.instantiators][INFO] - [rank: 0] Instantiating callback [2026-07-18 18:02:17,317][__main__][INFO] - [rank: 0] Instantiating loggers... [2026-07-18 18:02:17,317][fish_speech.utils.instantiators][INFO] - [rank: 0] Instantiating logger [2026-07-18 18:02:17,318][__main__][INFO] - [rank: 0] Instantiating trainer Trainer already configured with model summary callbacks: []. Skipping setting a default `ModelSummary` callback. GPU available: True (cuda), used: True TPU available: False, using: 0 TPU cores HPU available: False, using: 0 HPUs [2026-07-18 18:02:18,479][__main__][INFO] - [rank: 0] Logging hyperparameters! [2026-07-18 18:02:18,525][__main__][INFO] - [rank: 0] Starting training! [2026-07-18 18:02:18,527][__main__][INFO] - [rank: 0] Resuming from checkpoint: results/s2pro_egy_fast/checkpoints/step_000000200.ckpt Initializing distributed: GLOBAL_RANK: 0, MEMBER: 1/1 ---------------------------------------------------------------------------------------------------- distributed_backend=nccl All distributed processes registered. Starting with 1 processes ---------------------------------------------------------------------------------------------------- /opt/work/fish-speech/.venv/lib/python3.12/site-packages/lightning/pytorch/callbacks/model_checkpoint.py:751: Checkpoint directory /opt/work/fish-speech/results/s2pro_egy_fast/checkpoints exists and is not empty. Restoring states from the checkpoint path at results/s2pro_egy_fast/checkpoints/step_000000200.ckpt LOCAL_RANK: 0 - CUDA_VISIBLE_DEVICES: [0] [2026-07-18 18:02:20,535][fish_speech.models.text2semantic.lit_module][INFO] - [rank: 0] Set weight decay: 0.01 for 247 parameters [2026-07-18 18:02:20,536][fish_speech.models.text2semantic.lit_module][INFO] - [rank: 0] Set weight decay: 0.0 for 155 parameters | Name | Type | Params | Mode ------------------------------------------------------------------------ 0 | model | DualARTransformer | 4.6 B | train 1 | model.embeddings | Embedding | 398 M | train 2 | model.codebook_embeddings | Embedding | 104 M | train 3 | model.layers | ModuleList | 3.6 B | train 4 | model.norm | RMSNorm | 2.6 K | train 5 | model.fast_project_in | Identity | 0 | train 6 | model.fast_embeddings | Embedding | 10.7 M | train 7 | model.fast_layers | ModuleList | 410 M | train 8 | model.fast_norm | RMSNorm | 2.6 K | train 9 | model.fast_output | Linear | 10.7 M | train ------------------------------------------------------------------------ 7.1 M Trainable params 4.6 B Non-trainable params 4.6 B Total params 9,137.926 Total estimated model params size (MB) 503 Modules in train mode 0 Modules in eval mode Restored all states from the checkpoint at results/s2pro_egy_fast/checkpoints/step_000000200.ckpt [2026-07-18 18:02:20,856][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 2 / 6 files [2026-07-18 18:02:20,856][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 1 / 6 files [2026-07-18 18:02:20,857][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 2 / 6 files [2026-07-18 18:02:20,859][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 2 / 6 files [2026-07-18 18:02:20,860][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 2 / 6 files [2026-07-18 18:02:20,862][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 1 / 6 files [2026-07-18 18:02:20,860][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 1 / 6 files [2026-07-18 18:02:20,886][fish_speech.datasets.semantic][INFO] - [rank: 0] Reading 1 / 6 files [2026-07-18 18:02:20,930][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 9 groups of data [2026-07-18 18:02:20,935][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 33 groups of data [2026-07-18 18:02:20,954][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 40 groups of data [2026-07-18 18:02:20,977][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 2 groups of data [2026-07-18 18:02:20,977][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 60 groups of data [2026-07-18 18:02:20,986][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 36 groups of data [2026-07-18 18:02:20,999][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 50 groups of data [2026-07-18 18:02:21,022][fish_speech.datasets.semantic][INFO] - [rank: 0] Read total 12 groups of data Training: | | 0/? [00:00