internLM（书生·浦语大模型）Demo部署及使用

霓霓7053

已于 2024-04-02 17:44:33 修改

阅读量2.1k

点赞数 33

文章标签：语言模型

于 2024-04-02 17:17:28 首次发布

本文链接：https://blog.csdn.net/weixin_41173201/article/details/137238742

版权

使用InternStudio来部署环境及demo。InternStudio是上海AI实验室开发的一个云端集成开发环境。在这里有可以使用的微调数据集、能够快速搭建开发环境，并且操作产生的文件会保存在云盘，不会随着实例的销毁而销毁（需要存在/root目录下）InternStudioOpenAIDE 是面向算法开发者与研究员的云端集成开发环境。基于「容器实例」，「镜像中心」，「分布式训练」，「公开数据集」模块为用户提供 “算力、算法、数据” 深度学习模型训练三要素，让算法开发变得更简单、更方便https://studio.intern-ai.org.cn/

为了不浪费开发资源，创建开发机实例需要算力点（按每小时算），不同开发机需要的算力点额度不同。有时候资源不足需要排队等候。

一、开发机实例创建

可以在首页或开发机页面创建开发机

创建开发机时必须输入开发机名称、选择镜像和资源配置，可以看到各类GPU的资源使用程度，有些资源比较紧张可以优先选用其他GPU资源

demo实验的镜像选择cuda11.7即可

在开发机界面会显示所有曾经创建过的开发机，同时还可以查看运行中开发机使用时间和资源情况，以及一些操作日志，在使用完开发机后可以将开发机停止后释放

点击操作里的进入开发机就可以开始使用啦

开发机里有notebook、terminal等等，方便大家编程

二、环境配置

首先创建一个conda环境，studio-conda是InternStudio开箱即用的conda环境。conda是一个包和环境管理工具。包管理工具是一个用来自动化安装、升级、删除packages的工具。conda与语言无关，像跨平台版的apt或yum。conda只能在conda环境中安装包。

这个conda环境的名字就叫demo

studio-conda -o internlm-base -t demo
# 与 studio-conda 等效的配置方案
# conda create -n demo python==3.10 -y
# conda activate demo
# conda install pytorch==2.0.1 torchvision==0.15.2 torchaudio==2.0.2 pytorch-cuda=11.7 -c pytorch -c nvidia

配置完成后进入新创建的conda环境demo中

conda activate demo

安装环境包

pip install huggingface-hub==0.17.3
pip install transformers==4.34 
pip install psutil==5.9.8
pip install accelerate==0.24.1
pip install streamlit==1.32.2 
pip install matplotlib==3.8.3 
pip install modelscope==1.9.5
pip install sentencepiece==0.1.99

三、下载模型

首先创建文件夹及.py文件，注意，创建的文件需要在/root目录下，否则释放实例后文件都不会保存到云端

mkdir -p /root/demo
touch /root/demo/cli_demo.py
touch /root/demo/download_mini.py
cd /root/demo

在/root/demo/download_mini.py中复制以下代码，使用huggingface 官方提供的snapshot_download 方法下载完整模型参数

import os
from modelscope.hub.snapshot_download import snapshot_download

# 创建保存模型目录
os.system("mkdir /root/models")

# save_dir是模型保存到本地的目录
save_dir="/root/models"

#huggingface官方提供了snapshot_download 方法下载完整模型，参数众多、比较完善。相比下文另两个 python 方法，推荐 snapshot_download 方法来下载模型，支持断点续传、多线程、指定路径、配置代理、排除特定文件等功能。
#这里指定了下载的模型ID、保存路径以及模型的版本，如果想要下载其他模型可以修改第一个参数
snapshot_download("Shanghai_AI_Laboratory/internlm2-chat-1_8b", 
                  cache_dir=save_dir, 
                  revision='v1.1.0')

执行这个python文件就可以下载啦

python /root/demo/download_mini.py

四、模型运行

打开/root/demo/cli_demo.py文件，复制以下代码。代码对模型进行加载、对输入数据进行处理。

import torch
from transformers import AutoTokenizer, AutoModelForCausalLM


model_name_or_path = "/root/models/Shanghai_AI_Laboratory/internlm2-chat-1_8b"

tokenizer = AutoTokenizer.from_pretrained(model_name_or_path, trust_remote_code=True, device_map='cuda:0')
model = AutoModelForCausalLM.from_pretrained(model_name_or_path, trust_remote_code=True, torch_dtype=torch.bfloat16, device_map='cuda:0')
model = model.eval()

system_prompt = """You are an AI assistant whose name is InternLM (书生·浦语).
- InternLM (书生·浦语) is a conversational language model that is developed by Shanghai AI Laboratory (上海人工智能实验室). It is designed to be helpful, honest, and harmless.
- InternLM (书生·浦语) can understand and communicate fluently in the language chosen by the user such as English and 中文.
"""

messages = [(system_prompt, '')]

print("=============Welcome to InternLM chatbot, type 'exit' to exit.=============")

while True:
    input_text = input("\nUser  >>> ")
    input_text = input_text.replace(' ', '')
    if input_text == "exit":
        break

    length = 0
    for response, _ in model.stream_chat(tokenizer, input_text, messages):
        if response is not None:
            print(response[length:], flush=True, end="")
            length = len(response)

运行Demo

python /root/demo/cli_demo.py

等待模型加载完后，就可以在User >>> 后输入内容了，本人测试如下，可以看的出来大模型对问题的回答还不是很完美

五、部署实战营优秀大模型作品及从本地使用ssh连接studio端口

可以通过git命令获取模型代码相关文件，执行下载的py文件，然后运行

但在运行命令之前，需要先使用tmux将实验进程与终端窗口分离，否则ssh连接会导致终端关闭，程序运行终止。也可以先ssh连接上再回来运行模型

Tmux 使用教程 - 阮一峰的网络日志 (ruanyifeng.com)

环境里没有tmux，需要先安装

apt-get install tmux

安装完成后输入tmux就可以进入一个新终端，这在个终端中运行命令，会话建立后可以用detach、attach、kill命令离开、回到、杀死会话等。

streamlit run /root/Tutorial/helloworld/bajie_chat.py --server.address 127.0.0.1 --server.port 6006

Streamlit 是一个用于机器学习、数据可视化的 Python 框架，它能几行代码就构建出一个精美的在线 app 应用。一般使用前需要先安装，但目前环境里已经有了，代码里也要import streamlit这个包。

streamlit run xxx.py 运行后可以将代码加载在浏览器页面里，后面设置了一下服务器地址为本机，端口为6006

等待程序运行时，需要对端口环境配置本地PowerShell（win+r 输入powershell），才能用ssh连上，这一步需要在开发机点击ssh连接查看端口和密码，然后在本地powershell里使用下面的命令，输入密码连接

# 从本地使用 ssh 连接 studio 端口
# 将下方端口号 38374 替换成自己的端口号
ssh -CNg -L 6006:127.0.0.1:6006 root@ssh.intern-ai.org.cn -p 38374

连接好是这样的

然后打开浏览器输入127.0.0.1:6006就可以在浏览器里使用大模型了，可以看到每输入一个提问都会运行一次model。

以上就是这些~此时10%A100勉强撑得住，gpu经常飙到80%以上，再往后实验就需要更多算力啦

霓霓7053

关注

33
点赞
踩
42

收藏

觉得还不错? 一键收藏
2
评论
internLM（书生·浦语大模型）Demo部署及使用

简单跑一些internLM基础demo
复制链接

扫一扫