dummy-foo commited on
Commit
0aa9c28
·
verified ·
1 Parent(s): 3dc9a1c

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +3 -1
README.md CHANGED
@@ -6,7 +6,9 @@ language:
6
  pipeline_tag: text-generation
7
  ---
8
  [ChatGLM3-6B](https://github.com/THUDM/ChatGLM3)是一个中英双语大模型,本项目为ChatGLM3-6B加入日文能力。
9
- 通过sentencepiece在日文wiki和青空文库上训练BPE的tokenizer,词表扩充14000(64789 -> 78554),相比原生ChatGLM3的日文编码效率提升接近一倍,中文英文编码效率不变。
 
 
10
 
11
  共有两个模型:
12
  - [ChatGLM3-Japanese-Zero]( https://huggingface.co/dummy-foo/ChatGLM3-Japanese-Zero ):经过扩词表和resize后的模型,保留了ChatGLM3的中英文能力,尚无日文能力,但因为编码效率高,适合在日文语料上训练。
 
6
  pipeline_tag: text-generation
7
  ---
8
  [ChatGLM3-6B](https://github.com/THUDM/ChatGLM3)是一个中英双语大模型,本项目为ChatGLM3-6B加入日文能力。
9
+ 通过sentencepiece在日文wiki和青空文库上训练BPE的tokenizer,词表扩充14000(64789 -> 78554),相比原生ChatGLM3的日文编码效率提升接近一倍,中文英文编码效率不变。
10
+
11
+ 扩充词表后,在1B tokens上进行增量预训练,然后在22万对话上进行指令微调,得到最终的模型。
12
 
13
  共有两个模型:
14
  - [ChatGLM3-Japanese-Zero]( https://huggingface.co/dummy-foo/ChatGLM3-Japanese-Zero ):经过扩词表和resize后的模型,保留了ChatGLM3的中英文能力,尚无日文能力,但因为编码效率高,适合在日文语料上训练。