【书生浦语大模型实战营第三期】基础岛 OpenCompass 评测 InternLM-1.8B 实践

weixin_40574825

于 2024-08-09 07:14:03 发布

阅读量70

点赞数

分类专栏：书生浦语大模型实战营第三期文章标签：人工智能语言模型 python

本文链接：https://blog.csdn.net/weixin_40574825/article/details/141042881

版权

书生浦语大模型实战营第三期专栏收录该内容

9 篇文章 0 订阅

订阅专栏

1. 环境配置
在这里插入图片描述
查看支持的数据集和模型
列出所有跟 InternLM 及 C-Eval 相关的配置

在这里插入图片描述
2. 启动测评
确保按照上述步骤正确安装 OpenCompass 并准备好数据集后，可以通过以下命令评测 InternLM2-Chat-1.8B 模型在 C-Eval 数据集上的性能。

python run.py
--datasets ceval_gen \
--hf-path /share/new_models/Shanghai_AI_Laboratory/internlm2-chat-1_8b \  # HuggingFace 模型路径
--tokenizer-path /share/new_models/Shanghai_AI_Laboratory/internlm2-chat-1_8b \  # HuggingFace tokenizer 路径（如果与模型路径相同，可以省略）
--tokenizer-kwargs padding_side='left' truncation='left' trust_remote_code=True \  # 构建 tokenizer 的参数
--model-kwargs device_map='auto' trust_remote_code=True \  # 构建模型的参数
--max-seq-len 1024 \  # 模型可以接受的最大序列长度
--max-out-len 16 \  # 生成的最大 token 数
--batch-size 2  \  # 批量大小
--num-gpus 1  # 运行模型所需的 GPU 数量
--debug

当屏幕显示‘Starting inference process’时表示已正常开始评测。

在这里插入图片描述
评测完成后，将会看到：

在这里插入图片描述
也可以在生成的CSV文件中查看评测结果。

在这里插入图片描述

weixin_40574825

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
【书生浦语大模型实战营第三期】基础岛 OpenCompass 评测 InternLM-1.8B 实践

确保按照上述步骤正确安装 OpenCompass 并准备好数据集后，可以通过以下命令评测 InternLM2-Chat-1.8B 模型在 C-Eval 数据集上的性能。当屏幕显示‘Starting inference process’时表示已正常开始评测。列出所有跟 InternLM 及 C-Eval 相关的配置。也可以在生成的CSV文件中查看评测结果。查看支持的数据集和模型。
复制链接

扫一扫