chatglm2-6b在P40上做LORA微调 | 京东云技术团队

京东云技术团队

于 2023-09-06 11:08:20 发布

阅读量772

点赞数

分类专栏：人工智能硬核干货文章标签：京东云 chatglm2-6b 人工智能大模型

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/JDDTechTalk/article/details/132711076

版权

本文介绍了如何在京东集团EA的P40机器上利用ChatGLM2-6B大模型进行LORA（低秩适应大型语言模型）微调，包括模型性能提升、微调环境配置、LORA原理和实际操作步骤。作者郑少强强调领域内prompt构建的重要性。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

背景：

目前，大模型的技术应用已经遍地开花。最快的应用方式无非是利用自有垂直领域的数据进行模型微调。chatglm2-6b在国内开源的大模型上，效果比较突出。本文章分享的内容是用chatglm2-6b模型在集团EA的P40机器上进行垂直领域的LORA微调。

一、chatglm2-6b介绍

github： https://github.com/THUDM/ChatGLM2-6B

chatglm2-6b相比于chatglm有几方面的提升：

1. 性能提升： 相比初代模型，升级了 ChatGLM2-6B 的基座模型，同时在各项数据集评测上取得了不错的成绩；

2. 更长的上下文： 我们将基座模型的上下文长度（Context Length）由 ChatGLM-6B 的 2K 扩展到了 32K，并在对话阶段使用 8K 的上下文长度训练；

3. 更高效的推理： 基于 Multi-Query Attention 技术，ChatGLM2-6B 有更高效的推理速度和更低的显存占用：在官方的模型实现下，推理速度相比初代提升了 42%；

4. 更开放的协议：ChatGLM2-6B 权重对学术研究完全开放，在填写问卷进行登记后亦允许免费商业使用。

二、微调环境介绍

2.1 性能要求

推理这块，chatglm2-6b在精度是fp16上只需要14G的显存，所以P40是可以cover的。

EA上P40显卡的配置如下：

2.2

最低0.47元/天解锁文章

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。