Update README.md

eddie201906 · Jun 6, 2023 · 9a7b406 · 9a7b406
1 parent 1276361
commit 9a7b406
Showing 1 changed file with 8 additions and 0 deletions.
diff --git a/README.md b/README.md
@@ -35,8 +35,16 @@
    考虑到当前十分欠缺多轮共情对话数据集，我们一方面，构建了超过15万规模的 **单轮长文本心理咨询指令与答案（SoulChatCorpus-single_turn）** ，回答数量超过50万（指令数是当前的常见的心理咨询数据集 [PsyQA](PsyQA. https://github.com/thu-coai/PsyQA) 的6.7倍），并利用ChatGPT与GPT4，生成总共约100万轮次的 **多轮回答数据（SoulChatCorpus-multi_turn）** 。特别地，我们在预实验中发现，纯单轮长本文驱动的心理咨询模型会产生让用户感到厌烦的文本长度，而且不具备引导用户倾诉的能力，纯多轮心理咨询对话数据驱动的心理咨询模型则弱化了模型的建议能力，因此，我们混合SoulChatCorpus-single_turn和SoulChatCorpus-multi_turn构造成超过120万个样本的 **单轮与多轮混合的共情对话数据集SoulChatCorpus** 。所有数据采用“用户：xxx\n心理咨询师：xxx\n用户：xxx\n心理咨询师：”的形式统一为一种指令格式。
 
 ## 使用方法
+* 克隆本项目
+```bash
+cd ~
+git clone https://github.com/scutcyr/SoulChat.git
+```
+
 * 安装依赖
+需要注意的是torch的版本需要根据你的服务器实际的cuda版本选择，详情参考[pytorch安装指南](https://pytorch.org/get-started/previous-versions/)
 ```bash
+cd SoulChat
 conda env create -n proactivehealthgpt_py38 --file proactivehealthgpt_py38.yml
 conda activate proactivehealthgpt_py38