chenbhao commited on
Commit
2a8cecd
·
1 Parent(s): 8bc645c

Set base model hidden_size to 512 across all configs for 8G VRAM

Browse files
README.md CHANGED
@@ -100,9 +100,16 @@ pip install -e ".[rl,serve,demo]"
100
  也可通过 `--config` 指定其它配置,任意 CLI 参数都能覆盖 YAML 中的默认值:
101
 
102
  ```bash
 
 
 
 
 
103
  bash runs/lm.sh # 使用 configs/model/lm.yaml
104
  bash runs/vlm.sh --config configs/model/vlm_moe.yaml
105
  bash runs/vam.sh --epochs 5 # 在 vam.yaml 基础上覆盖单字段
 
 
106
  ```
107
 
108
  ### 推理 / 对话
 
100
  也可通过 `--config` 指定其它配置,任意 CLI 参数都能覆盖 YAML 中的默认值:
101
 
102
  ```bash
103
+ bash runs/train_tokenizer.sh --data_path dataset/sft_t2t_mini.jsonl \
104
+ --vocab_size 6400 \
105
+ --checkpoint_dir ../checkpoint \
106
+ --no_eval
107
+
108
  bash runs/lm.sh # 使用 configs/model/lm.yaml
109
  bash runs/vlm.sh --config configs/model/vlm_moe.yaml
110
  bash runs/vam.sh --epochs 5 # 在 vam.yaml 基础上覆盖单字段
111
+
112
+
113
  ```
114
 
115
  ### 推理 / 对话
configs/model/lm.yaml CHANGED
@@ -1,6 +1,6 @@
1
  # LM 训练配置(纯文本语言模型)
2
  model:
3
- hidden_size: 768
4
  num_hidden_layers: 8
5
  use_moe: 0 # 1 启用 MoE
6
  vocab_size: 6400
 
1
  # LM 训练配置(纯文本语言模型)
2
  model:
3
+ hidden_size: 512
4
  num_hidden_layers: 8
5
  use_moe: 0 # 1 启用 MoE
6
  vocab_size: 6400
configs/model/lm_moe.yaml CHANGED
@@ -1,6 +1,6 @@
1
  # LM-MoE 训练配置(纯文本语言模型,启用 MoE)
2
  model:
3
- hidden_size: 768
4
  num_hidden_layers: 8
5
  use_moe: 1 # 1 启用 MoE
6
  num_experts: 4
 
1
  # LM-MoE 训练配置(纯文本语言模型,启用 MoE)
2
  model:
3
+ hidden_size: 512
4
  num_hidden_layers: 8
5
  use_moe: 1 # 1 启用 MoE
6
  num_experts: 4
configs/model/vam.yaml CHANGED
@@ -1,6 +1,6 @@
1
  # VAM 训练配置(文本 + 视觉 + 语音全模态)
2
  model:
3
- hidden_size: 768
4
  num_hidden_layers: 8
5
  use_moe: 0 # 1 启用 MoE
6
  vocab_size: 6400
@@ -10,7 +10,7 @@ model:
10
  dropout: 0.0
11
  # Talker(语音生成)相关
12
  num_talker_hidden_layers: 4
13
- talker_hidden_size: 768
14
  # 音频相关
15
  audio_special_token: "<|audio_pad|>"
16
  audio_ids: [16]
 
1
  # VAM 训练配置(文本 + 视觉 + 语音全模态)
2
  model:
3
+ hidden_size: 512
4
  num_hidden_layers: 8
5
  use_moe: 0 # 1 启用 MoE
6
  vocab_size: 6400
 
10
  dropout: 0.0
11
  # Talker(语音生成)相关
12
  num_talker_hidden_layers: 4
13
+ talker_hidden_size: 512
14
  # 音频相关
15
  audio_special_token: "<|audio_pad|>"
16
  audio_ids: [16]
configs/model/vam_moe.yaml CHANGED
@@ -1,6 +1,6 @@
1
  # VAM-MoE 训练配置(文本 + 视觉 + 语音全模态,启用 MoE)
2
  model:
3
- hidden_size: 768
4
  num_hidden_layers: 8
5
  use_moe: 1 # 1 启用 MoE
6
  num_experts: 4
@@ -15,7 +15,7 @@ model:
15
  dropout: 0.0
16
  # Talker(语音生成)相关
17
  num_talker_hidden_layers: 4
18
- talker_hidden_size: 768
19
  # 音频相关
20
  audio_special_token: "<|audio_pad|>"
21
  audio_ids: [16]
 
1
  # VAM-MoE 训练配置(文本 + 视觉 + 语音全模态,启用 MoE)
2
  model:
3
+ hidden_size: 512
4
  num_hidden_layers: 8
5
  use_moe: 1 # 1 启用 MoE
6
  num_experts: 4
 
15
  dropout: 0.0
16
  # Talker(语音生成)相关
17
  num_talker_hidden_layers: 4
18
+ talker_hidden_size: 512
19
  # 音频相关
20
  audio_special_token: "<|audio_pad|>"
21
  audio_ids: [16]
configs/model/vlm.yaml CHANGED
@@ -1,6 +1,6 @@
1
  # VLM 训练配置(文本 + 视觉多模态)
2
  model:
3
- hidden_size: 768
4
  num_hidden_layers: 8
5
  use_moe: 0 # 1 启用 MoE
6
  vocab_size: 6400
 
1
  # VLM 训练配置(文本 + 视觉多模态)
2
  model:
3
+ hidden_size: 512
4
  num_hidden_layers: 8
5
  use_moe: 0 # 1 启用 MoE
6
  vocab_size: 6400
configs/model/vlm_moe.yaml CHANGED
@@ -1,6 +1,6 @@
1
  # VLM-MoE 训练配置(文本 + 视觉多模态,启用 MoE)
2
  model:
3
- hidden_size: 768
4
  num_hidden_layers: 8
5
  use_moe: 1 # 1 启用 MoE
6
  num_experts: 4
 
1
  # VLM-MoE 训练配置(文本 + 视觉多模态,启用 MoE)
2
  model:
3
+ hidden_size: 512
4
  num_hidden_layers: 8
5
  use_moe: 1 # 1 启用 MoE
6
  num_experts: 4