internLM(书生·浦语大模型)Demo部署及使用

     使用InternStudio来部署环境及demo。InternStudio是上海AI实验室开发的一个云端集成开发环境。在这里有可以使用的微调数据集、能够快速搭建开发环境,并且操作产生的文件会保存在云盘,不会随着实例的销毁而销毁(需要存在/root目录下)InternStudioOpenAIDE 是面向算法开发者与研究员的云端集成开发环境。基于「容器实例」,「镜像中心」,「分布式训练」,「公开数据集」模块为用户提供 “算力、算法、数据” 深度学习模型训练三要素,让算法开发变得更简单、更方便icon-default.png?t=N7T8https://studio.intern-ai.org.cn/

为了不浪费开发资源,创建开发机实例需要算力点(按每小时算),不同开发机需要的算力点额度不同。有时候资源不足需要排队等候。

一、开发机实例创建

可以在首页或开发机页面创建开发机

创建开发机时必须输入开发机名称、选择镜像和资源配置,可以看到各类GPU的资源使用程度,有些资源比较紧张可以优先选用其他GPU资源

demo实验的镜像选择cuda11.7即可

在开发机界面会显示所有曾经创建过的开发机,同时还可以查看运行中开发机使用时间和资源情况,以及一些操作日志,在使用完开发机后可以将开发机停止后释放

点击操作里的进入开发机就可以开始使用啦

开发机里有notebook、terminal等等,方便大家编程

二、环境配置

首先创建一个conda环境,studio-conda是InternStudio开箱即用的conda环境。conda是一个包和环境管理工具。包管理工具是一个用来自动化安装、升级、删除packages的工具。conda与语言无关,像跨平台版的apt或yum。conda只能在conda环境中安装包。

这个conda环境的名字就叫demo

studio-conda -o internlm-base -t demo
# 与 studio-conda 等效的配置方案
# conda create -n demo python==3.10 -y
# conda activate demo
# conda install pytorch==2.0.1 torchvision==0.15.2 torchaudio==2.0.2 pytorch-cuda=11.7 -c pytorch -c nvidia

配置完成后进入新创建的conda环境demo中

conda activate demo

安装环境包

pip install huggingface-hub==0.17.3
pip install transformers==4.34 
pip install psutil==5.9.8
pip install accelerate==0.24.1
pip install streamlit==1.32.2 
pip install matplotlib==3.8.3 
pip install modelscope==1.9.5
pip install sentencepiece==0.1.99

三、下载模型

首先创建文件夹及.py文件,注意,创建的文件需要在/root目录下,否则释放实例后文件都不会保存到云端

mkdir -p /root/demo
touch /root/demo/cli_demo.py
touch /root/demo/download_mini.py
cd /root/demo

在/root/demo/download_mini.py中复制以下代码,使用huggingface 官方提供的snapshot_download 方法下载完整模型参数

import os
from modelscope.hub.snapshot_download import snapshot_download

# 创建保存模型目录
os.system("mkdir /root/models")

# save_dir是模型保存到本地的目录
save_dir="/root/models"

#huggingface官方提供了snapshot_download 方法下载完整模型,参数众多、比较完善。相比下文另两个 python 方法,推荐 snapshot_download 方法来下载模型,支持断点续传、多线程、指定路径、配置代理、排除特定文件等功能。
#这里指定了下载的模型ID、保存路径以及模型的版本,如果想要下载其他模型可以修改第一个参数
snapshot_download("Shanghai_AI_Laboratory/internlm2-chat-1_8b", 
                  cache_dir=save_dir, 
                  revision='v1.1.0')

执行这个python文件就可以下载啦

python /root/demo/download_mini.py

四、模型运行

打开/root/demo/cli_demo.py文件,复制以下代码。代码对模型进行加载、对输入数据进行处理。

import torch
from transformers import AutoTokenizer, AutoModelForCausalLM


model_name_or_path = "/root/models/Shanghai_AI_Laboratory/internlm2-chat-1_8b"

tokenizer = AutoTokenizer.from_pretrained(model_name_or_path, trust_remote_code=True, device_map='cuda:0')
model = AutoModelForCausalLM.from_pretrained(model_name_or_path, trust_remote_code=True, torch_dtype=torch.bfloat16, device_map='cuda:0')
model = model.eval()

system_prompt = """You are an AI assistant whose name is InternLM (书生·浦语).
- InternLM (书生·浦语) is a conversational language model that is developed by Shanghai AI Laboratory (上海人工智能实验室). It is designed to be helpful, honest, and harmless.
- InternLM (书生·浦语) can understand and communicate fluently in the language chosen by the user such as English and 中文.
"""

messages = [(system_prompt, '')]

print("=============Welcome to InternLM chatbot, type 'exit' to exit.=============")

while True:
    input_text = input("\nUser  >>> ")
    input_text = input_text.replace(' ', '')
    if input_text == "exit":
        break

    length = 0
    for response, _ in model.stream_chat(tokenizer, input_text, messages):
        if response is not None:
            print(response[length:], flush=True, end="")
            length = len(response)

运行Demo

python /root/demo/cli_demo.py

等待模型加载完后,就可以在User >>> 后输入内容了,本人测试如下,可以看的出来大模型对问题的回答还不是很完美

五、部署实战营优秀大模型作品及从本地使用ssh连接studio端口

可以通过git命令获取模型代码相关文件,执行下载的py文件,然后运行

但在运行命令之前,需要先使用tmux将实验进程与终端窗口分离,否则ssh连接会导致终端关闭,程序运行终止。也可以先ssh连接上再回来运行模型

Tmux 使用教程 - 阮一峰的网络日志 (ruanyifeng.com)

环境里没有tmux,需要先安装

apt-get install tmux

安装完成后输入tmux就可以进入一个新终端,这在个终端中运行命令,会话建立后可以用detach、attach、kill命令离开、回到、杀死会话等。

streamlit run /root/Tutorial/helloworld/bajie_chat.py --server.address 127.0.0.1 --server.port 6006

Streamlit 是一个用于机器学习、数据可视化的 Python 框架,它能几行代码就构建出一个精美的在线 app 应用。一般使用前需要先安装,但目前环境里已经有了,代码里也要import streamlit这个包。

streamlit run xxx.py 运行后可以将代码加载在浏览器页面里,后面设置了一下服务器地址为本机,端口为6006

等待程序运行时,需要对端口环境配置本地PowerShell(win+r 输入powershell),才能用ssh连上,这一步需要在开发机点击ssh连接查看端口和密码,然后在本地powershell里使用下面的命令,输入密码连接

# 从本地使用 ssh 连接 studio 端口
# 将下方端口号 38374 替换成自己的端口号
ssh -CNg -L 6006:127.0.0.1:6006 root@ssh.intern-ai.org.cn -p 38374

连接好是这样的

然后打开浏览器输入127.0.0.1:6006就可以在浏览器里使用大模型了,可以看到每输入一个提问都会运行一次model。

以上就是这些~此时10%A100勉强撑得住,gpu经常飙到80%以上,再往后实验就需要更多算力啦

  • 33
    点赞
  • 42
    收藏
    觉得还不错? 一键收藏
  • 2
    评论
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值