Set base model hidden_size to 512 across all configs for 8G VRAM
Browse files- README.md +7 -0
- configs/model/lm.yaml +1 -1
- configs/model/lm_moe.yaml +1 -1
- configs/model/vam.yaml +2 -2
- configs/model/vam_moe.yaml +2 -2
- configs/model/vlm.yaml +1 -1
- configs/model/vlm_moe.yaml +1 -1
README.md
CHANGED
|
@@ -100,9 +100,16 @@ pip install -e ".[rl,serve,demo]"
|
|
| 100 |
也可通过 `--config` 指定其它配置,任意 CLI 参数都能覆盖 YAML 中的默认值:
|
| 101 |
|
| 102 |
```bash
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 103 |
bash runs/lm.sh # 使用 configs/model/lm.yaml
|
| 104 |
bash runs/vlm.sh --config configs/model/vlm_moe.yaml
|
| 105 |
bash runs/vam.sh --epochs 5 # 在 vam.yaml 基础上覆盖单字段
|
|
|
|
|
|
|
| 106 |
```
|
| 107 |
|
| 108 |
### 推理 / 对话
|
|
|
|
| 100 |
也可通过 `--config` 指定其它配置,任意 CLI 参数都能覆盖 YAML 中的默认值:
|
| 101 |
|
| 102 |
```bash
|
| 103 |
+
bash runs/train_tokenizer.sh --data_path dataset/sft_t2t_mini.jsonl \
|
| 104 |
+
--vocab_size 6400 \
|
| 105 |
+
--checkpoint_dir ../checkpoint \
|
| 106 |
+
--no_eval
|
| 107 |
+
|
| 108 |
bash runs/lm.sh # 使用 configs/model/lm.yaml
|
| 109 |
bash runs/vlm.sh --config configs/model/vlm_moe.yaml
|
| 110 |
bash runs/vam.sh --epochs 5 # 在 vam.yaml 基础上覆盖单字段
|
| 111 |
+
|
| 112 |
+
|
| 113 |
```
|
| 114 |
|
| 115 |
### 推理 / 对话
|
configs/model/lm.yaml
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
# LM 训练配置(纯文本语言模型)
|
| 2 |
model:
|
| 3 |
-
hidden_size:
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 0 # 1 启用 MoE
|
| 6 |
vocab_size: 6400
|
|
|
|
| 1 |
# LM 训练配置(纯文本语言模型)
|
| 2 |
model:
|
| 3 |
+
hidden_size: 512
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 0 # 1 启用 MoE
|
| 6 |
vocab_size: 6400
|
configs/model/lm_moe.yaml
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
# LM-MoE 训练配置(纯文本语言模型,启用 MoE)
|
| 2 |
model:
|
| 3 |
-
hidden_size:
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 1 # 1 启用 MoE
|
| 6 |
num_experts: 4
|
|
|
|
| 1 |
# LM-MoE 训练配置(纯文本语言模型,启用 MoE)
|
| 2 |
model:
|
| 3 |
+
hidden_size: 512
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 1 # 1 启用 MoE
|
| 6 |
num_experts: 4
|
configs/model/vam.yaml
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
# VAM 训练配置(文本 + 视觉 + 语音全模态)
|
| 2 |
model:
|
| 3 |
-
hidden_size:
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 0 # 1 启用 MoE
|
| 6 |
vocab_size: 6400
|
|
@@ -10,7 +10,7 @@ model:
|
|
| 10 |
dropout: 0.0
|
| 11 |
# Talker(语音生成)相关
|
| 12 |
num_talker_hidden_layers: 4
|
| 13 |
-
talker_hidden_size:
|
| 14 |
# 音频相关
|
| 15 |
audio_special_token: "<|audio_pad|>"
|
| 16 |
audio_ids: [16]
|
|
|
|
| 1 |
# VAM 训练配置(文本 + 视觉 + 语音全模态)
|
| 2 |
model:
|
| 3 |
+
hidden_size: 512
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 0 # 1 启用 MoE
|
| 6 |
vocab_size: 6400
|
|
|
|
| 10 |
dropout: 0.0
|
| 11 |
# Talker(语音生成)相关
|
| 12 |
num_talker_hidden_layers: 4
|
| 13 |
+
talker_hidden_size: 512
|
| 14 |
# 音频相关
|
| 15 |
audio_special_token: "<|audio_pad|>"
|
| 16 |
audio_ids: [16]
|
configs/model/vam_moe.yaml
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
# VAM-MoE 训练配置(文本 + 视觉 + 语音全模态,启用 MoE)
|
| 2 |
model:
|
| 3 |
-
hidden_size:
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 1 # 1 启用 MoE
|
| 6 |
num_experts: 4
|
|
@@ -15,7 +15,7 @@ model:
|
|
| 15 |
dropout: 0.0
|
| 16 |
# Talker(语音生成)相关
|
| 17 |
num_talker_hidden_layers: 4
|
| 18 |
-
talker_hidden_size:
|
| 19 |
# 音频相关
|
| 20 |
audio_special_token: "<|audio_pad|>"
|
| 21 |
audio_ids: [16]
|
|
|
|
| 1 |
# VAM-MoE 训练配置(文本 + 视觉 + 语音全模态,启用 MoE)
|
| 2 |
model:
|
| 3 |
+
hidden_size: 512
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 1 # 1 启用 MoE
|
| 6 |
num_experts: 4
|
|
|
|
| 15 |
dropout: 0.0
|
| 16 |
# Talker(语音生成)相关
|
| 17 |
num_talker_hidden_layers: 4
|
| 18 |
+
talker_hidden_size: 512
|
| 19 |
# 音频相关
|
| 20 |
audio_special_token: "<|audio_pad|>"
|
| 21 |
audio_ids: [16]
|
configs/model/vlm.yaml
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
# VLM 训练配置(文本 + 视觉多模态)
|
| 2 |
model:
|
| 3 |
-
hidden_size:
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 0 # 1 启用 MoE
|
| 6 |
vocab_size: 6400
|
|
|
|
| 1 |
# VLM 训练配置(文本 + 视觉多模态)
|
| 2 |
model:
|
| 3 |
+
hidden_size: 512
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 0 # 1 启用 MoE
|
| 6 |
vocab_size: 6400
|
configs/model/vlm_moe.yaml
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
# VLM-MoE 训练配置(文本 + 视觉多模态,启用 MoE)
|
| 2 |
model:
|
| 3 |
-
hidden_size:
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 1 # 1 启用 MoE
|
| 6 |
num_experts: 4
|
|
|
|
| 1 |
# VLM-MoE 训练配置(文本 + 视觉多模态,启用 MoE)
|
| 2 |
model:
|
| 3 |
+
hidden_size: 512
|
| 4 |
num_hidden_layers: 8
|
| 5 |
use_moe: 1 # 1 启用 MoE
|
| 6 |
num_experts: 4
|