fka/prompts.chat
Viewer • Updated • 2.14k • 26.5k • 9.8k
这是一个基于 ChatGLM-3-6B 进行 LoRA 微调 的中文对话生成模型。该模型的目标是提升对话生成的质量,特别是在开放式对话和问答任务中。LoRA 微调技术通过低秩适配层优化了预训练模型,减少了计算开销。
目前,模型在对话生成的质量上会继续进行微调和改进,以优化性能和适应更多场景。
模型在一些对话生成任务上的初步评估结果如下:
当前模型的表现并未达到最佳效果,但随着更多数据和进一步的微调,预期会有所改进。
这个模型适用于构建中文对话系统,特别是在:
你可以使用以下代码来加载并使用该模型:
from transformers import AutoModelForCausalLM, AutoTokenizer
# 加载模型和 tokenizer
model_name = "Longz1003/chatglm_lora_mimeng" # 替换为你的模型路径
model = AutoModelForCausalLM.from_pretrained(model_name)
tokenizer = AutoTokenizer.from_pretrained(model_name)
# 测试模型
inputs = tokenizer("你好,今天的天气怎么样?", return_tensors="pt")
outputs = model.generate(**inputs)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))
torch>=1.10.0
transformers>=4.30.0
accelerate>=0.18.0
datasets>=2.0.0
scipy>=1.7.0
sentencepiece>=0.1.96
pytorch-lightning>=1.5.0
pyyaml>=5.4.1
tqdm>=4.62.0
requests>=2.26.0
huggingface_hub>=0.12.0
tensorboard>=2.6.0
scikit-learn>=0.24.2
Base model
zai-org/chatglm-6b