【手把手带你微调 Llama3】 改变大模型的自我认知,单卡就能训

微调Llama3的自我认知后

当你问Llama3中文问题:

“你叫什么名字?”、

“做个自我介绍”、

“你好”

Llama3 会用中文回答 :

“我是AI在手”

(如下图)
在这里插入图片描述

1、环境安装



  

\# nvidia 显卡  显存16G

# pytorch    2.2.2   py3.10\_cuda11.7\_cudnn8.5.0\_0  
conda create --name xtuner python=3.10 -y  
  
# 激活环境  
conda activate xtuner  
  
# 安装最新版 xtuner  
pip install xtuner
2、自我认知训练数据集准备

为了让模型能够让模型认清自己的身份——“我是谁,我来自哪里”,知道在询问自己是谁的时候回复成我们想要的样子,我们就需要通过在微调数据集中大量掺杂这部分的数据。

首先我们先创建一个文件夹来存放我们这次训练所需要的所有文件。

# 前半部分是创建一个项目工程文件夹,后半部分是进入该文件夹。  
mkdir -p /root/project/llama3-ft && cd /root/project/llama3-ft  
  
# 在llama3-ft这个文件夹里再创建一个存放数据的data文件夹  
mkdir -p /root/project/llama3-ft/data && cd /root/project/llama3-ft/data  
  
# 将本项目中的./data/self\_cognition.json 文件复制到 /root/project/llama3-ft/data中  
cp <替换本Git项目目录\>/data/self\_cognition.json /root/project/llama3-ft/data

通过文本编辑器打开 self_cognition.json 文件(下载地址:https://github.com/wwewwt/Llama3-XTuner-CN/blob/main/data/self_cognition.json),将其中的“ ”替换成“AI在手”,“”替换成“AI大模型在手公众号”,文本替换后的效果如下:

\[  
  {  
    "instruction": "你好",  
    "input": "",  
    "output": "您好,我是AI在手,一个由AI大模型在手公众号开发的 AI 助手,很高兴认识您。请问我能为您做些什么?"  
  },  
  {  
    "instruction": "你好",  
    "input": "",  
    "output": "您好,我是AI在手,一个由AI大模型在手公众号打造的人工智能助手,请问有什么可以帮助您的吗?"  
  }  
\]

之后我们可以在 data 目录下新建一个 generate_data.py 文件,将以下代码复制进去,然后运行该脚本即可生成数据集。

# 创建 \`generate\_data.py\` 文件  
touch /root/project/llama3-ft/data/generate\_data.py

打开 generate_data.py 文件后将下面的内容复制进去。

import json    
  
\# 定义一个函数来生成jsonl文件  
def generate\_jsonl(json\_data, filename):  
    with open(filename, 'w', encoding\='utf-8') as f:  
        for item in json\_data:  
            \# 将每个JSON对象转换为字符串,并写入文件  
            f.write(json.dumps(item, ensure\_ascii\=False) + '\\n')  
  
  
\# 打开JSON文件并读取内容    
with open('self\_cognition.json', 'r') as f:    
    data \= json.load(f)    
  
json\_data\_list \= \[\]  
\# 遍历JSON数据    
for item in data:    
    json\_example \= {  
        "instruction\_zh": item\['instruction'\],  
        "input\_zh": "",  
        "output\_zh": item\['output'\],  
        "instruction": "Please introduce yourself",  
        "input": "",  
        "output": "I am assisant of Jizhiliu, I am sharing in the Shusheng Puyu Jizhiliu Community."  
    }  
    json\_data\_list.append(json\_example)  
generate\_jsonl(json\_data\_list, 'self\_cognition.jsonl')

运行 generate_data.py 文件即可。

cd /root/project/llama3-ft/data && python generate\_data.py

可以看到在data的路径下生成了一个名为 self_cognition.jsonl 的文件。

最后我们创建 silk-road/alpaca-data-gpt4-chinese 文件夹并将self_cognition.jsonl复制其中:

mkdir -p /root/project/llama3-ft/silk-road/alpaca-data-gpt4-chinese   
cp /root/project/llama3-ft/data/self\_cognition.jsonl /root/project/llama3-ft/silk-road/alpaca-data-gpt4-chinese

这就是我们用于自我认知微调的数据集,当前的项目工程目录文件树如下:

|-- /  
    |-- data/  
        |-- self_cognition.json  
        |-- generate_data.py  
        |-- self_cognition.jsonl  
    |-- silk-road/  
        |-- alpaca-data-gpt4-chinese/  
            |-- self_cognition.jsonl
3、下载Llama-3-8B-Instruct模型


pip install -U huggingface\_hub

  
mkdir -p /root/model/  
  
huggingface-cli download --token <替换成你的 huggingface token\>  --resume-download meta-llama/Meta-Llama-3-8B-Instruct --local-dir-use-symlinks False  --local-dir /root/model/meta-llama/Meta-Llama-3-8B-Instruct
4、Xtuner配置文件准备

下载配置文件模板

cd /root/project/llama3-ft  
  
# 使用 XTuner 中的 copy-cfg 功能将 config 文件复制到指定的位置  
xtuner copy-cfg llama2\_7b\_chat\_qlora\_alpaca\_zh\_e3 .  
  
# 修改文件名  
mv llama2\_7b\_chat\_qlora\_alpaca\_zh\_e3\_copy.py llama3\_8b\_chat\_qlora\_alpaca\_zh\_e3\_self.py

修改 llama3_8b_chat_qlora_alpaca_zh_e3_self.py 文件中的 “pretrained_model_name_or_path” 变量的值为下载到本地的Llama 3 模型的路径,并增大epoch:

\- pretrained\_model\_name\_or\_path = 'meta-llama/Meta-Llama-3-8B-Instruct'  
\+ pretrained\_model\_name\_or\_path = '/root/model/meta-llama/Meta-Llama-3-8B-Instruct'  
  
# 因为训练集的条数只有80,所以这里增大epoch,才能充分训练  
\- max\_epochs = 3  
\+ max\_epochs = 100  
  
# 修改评估问题  
\- '请给我介绍五个上海的景点', 'Please tell me five scenic spots in Shanghai'  
\+ '请做一个自我介绍', '请介绍一下你自己'
5、训练模型


cd /root/project/llama3-ft

  
# 开始训练,使用 deepspeed 加速,A100 40G显存 耗时24分钟  
xtuner train llama3\_8b\_chat\_qlora\_alpaca\_zh\_e3\_self.py --work-dir ./train\_self --deepspeed deepspeed\_zero2  
  
# 获取Lora  
mkdir hf\_self  
xtuner convert pth\_to\_hf llama3\_8b\_chat\_qlora\_alpaca\_zh\_e3\_self.py ./train\_self/iter\_1600.pth ./hf\_self/  
  
# 模型合并  
export MKL\_SERVICE\_FORCE\_INTEL=1  
xtuner convert merge /root/model/meta-llama/Meta-Llama-3-8B-Instruct ./hf\_self ./merged\_model\_self

merged_model_self 文件夹中即为完成了自我认知微调后的 Llama 3 模型。

修改其中的 special_tokens_map.json 文件内容为

`{     "bos_token": "<|begin_of_text|>",     "eos_token": "<|end_of_text|>"   `

`}`

  



6、推理验证


# 创建 inference.py 文件

touch /root/project/llama3-ft/inference.py

打开 inference.py 文件后将下面的内容复制进去。

import transformers  
import torch  
  
model\_id \= "/root/project/llama3-ft/merged\_model\_self"  
  
pipeline \= transformers.pipeline(  
    "text-generation",  
    model\=model\_id,  
    model\_kwargs\={"torch\_dtype": torch.bfloat16},  
    device\="cuda",  
)  
  
terminators \= \[  
    pipeline.tokenizer.eos\_token\_id,  
    pipeline.tokenizer.convert\_tokens\_to\_ids("<|eot\_id|>")  
\]  
  
messages \= \[  
    {"role": "system", "content": ""},  
    {"role": "user", "content": "你叫什么名字"},  
\]  
  
prompt \= pipeline.tokenizer.apply\_chat\_template(  
        messages,   
        tokenize\=False,   
        add\_generation\_prompt\=True  
)  
  
outputs \= pipeline(  
    prompt,  
    max\_new\_tokens\=256,  
    eos\_token\_id\=terminators,  
    do\_sample\=True,  
    temperature\=0.6,  
    top\_p\=0.9,  
)  
print(outputs\[0\]\["generated\_text"\]\[len(prompt):\])

运行 inference.py 文件即可。

cd /root/project/llama3-ft && python inference.py  
您好,我名叫AI在手,是由AI大模型在手公众号开发的 AI 助手。我的任务是为用户提供回答和帮助。  
“”

训练完后的完整的项目工程目录文件树如下:

|-- /  
    |-- llama3_8b_chat_qlora_alpaca_zh_e3_self.py  
    |-- merged_model_self/  
        |-- config.json  
        |-- pytorch_model.bin.index.json  
        |-- pytorch_model-00006-of-00009.bin  
        |-- pytorch_model-00002-of-00009.bin  
        |-- pytorch_model-00001-of-00009.bin  
        |-- pytorch_model-00003-of-00009.bin  
        |-- tokenizer_config.json  
        |-- pytorch_model-00009-of-00009.bin  
        |-- pytorch_model-00004-of-00009.bin  
        |-- special_tokens_map.json  
        |-- pytorch_model-00005-of-00009.bin  
        |-- pytorch_model-00007-of-00009.bin  
        |-- pytorch_model-00008-of-00009.bin  
        |-- tokenizer.json  
        |-- generation_config.json  
    |-- hf_self/  
        |-- adapter_config.json  
        |-- xtuner_config.py  
        |-- adapter_model.bin  
        |-- README.md  
    |-- train_self/  
        |-- llama3_8b_chat_qlora_alpaca_zh_e3_self.py  
        |-- zero_to_fp32.py  
        |-- last_checkpoint  
        |-- iter_1600.pth/  
            |-- bf16_zero_pp_rank_0_mp_rank_00_optim_states.pt  
            |-- mp_rank_00_model_states.pt  
    |-- data/  
        |-- self_cognition.json  
        |-- generate_data.py  
        |-- self_cognition.jsonl  
    |-- silk-road/  
        |-- alpaca-data-gpt4-chinese/  
            |-- self_cognition.jsonl
7、ToDo List

调整Xtuner训练模板,支持英语对话中的自我认知微调。

如何学习大模型 AGI ?

由于新岗位的生产效率,要优于被取代岗位的生产效率,所以实际上整个社会的生产效率是提升的。

但是具体到个人,只能说是:

“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。

这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。

我在一线互联网企业工作十余年里,指导过不少同行后辈。帮助很多人得到了学习和成长。

我意识到有很多经验和知识值得分享给大家,也可以通过我们的能力和经验解答大家在人工智能学习中的很多困惑,所以在工作繁忙的情况下还是坚持各种整理和分享。但苦于知识传播途径有限,很多互联网行业朋友无法获得正确的资料得到学习提升,故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。

-END-


👉AGI大模型学习路线汇总👈

大模型学习路线图,整体分为7个大的阶段:(全套教程文末领取哈)

第一阶段: 从大模型系统设计入手,讲解大模型的主要方法;

第二阶段: 在通过大模型提示词工程从Prompts角度入手更好发挥模型的作用;

第三阶段: 大模型平台应用开发借助阿里云PAI平台构建电商领域虚拟试衣系统;

第四阶段: 大模型知识库应用开发以LangChain框架为例,构建物流行业咨询智能问答系统;

第五阶段: 大模型微调开发借助以大健康、新零售、新媒体领域构建适合当前领域大模型;

第六阶段: 以SD多模态大模型为主,搭建了文生图小程序案例;

第七阶段: 以大模型平台应用与开发为主,通过星火大模型,文心大模型等成熟大模型构建大模型行业应用。

👉AGI大模型实战案例👈

光学理论是没用的,要学会跟着一起做,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战案例来学习。

在这里插入图片描述

👉AGI大模型视频和PDF合集👈

观看零基础学习书籍和视频,看书籍和视频学习是最快捷也是最有效果的方式,跟着视频中老师的思路,从基础到深入,还是很容易入门的。
在这里插入图片描述
在这里插入图片描述

👉学会后的收获:👈

• 基于大模型全栈工程实现(前端、后端、产品经理、设计、数据分析等),通过这门课可获得不同能力;

• 能够利用大模型解决相关实际项目需求: 大数据时代,越来越多的企业和机构需要处理海量数据,利用大模型技术可以更好地处理这些数据,提高数据分析和决策的准确性。因此,掌握大模型应用开发技能,可以让程序员更好地应对实际项目需求;

• 基于大模型和企业数据AI应用开发,实现大模型理论、掌握GPU算力、硬件、LangChain开发框架和项目实战技能, 学会Fine-tuning垂直训练大模型(数据准备、数据蒸馏、大模型部署)一站式掌握;

• 能够完成时下热门大模型垂直领域模型训练能力,提高程序员的编码能力: 大模型应用开发需要掌握机器学习算法、深度学习框架等技术,这些技术的掌握可以提高程序员的编码能力和分析能力,让程序员更加熟练地编写高质量的代码。

👉获取方式:

😝有需要的小伙伴,可以保存图片到wx扫描二v码免费领取【保证100%免费】🆓

  • 28
    点赞
  • 9
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值