第四期书生大模型实战营【基础岛】—— OpenCompass 评测书生大模型实践

本文链接：https://blog.youkuaiyun.com/weixin_45730545/article/details/145529568

OpenCompass 评测书生大模型实践

任务描述
API 模式评测
本地直接评测
InternLM2-Chat-1.8B 部署后评测

任务描述

API 模式评测：使用 OpenCompass 评测浦语 API 记录复现过程并截图。
本地直接评测：使用 OpenCompass 评测 InternLM2.5-1.8B-Chat 模型在 ceval 数据集上的性能，记录复现过程并截图。（可选）
使用 OpenCompass 进行主观评测。（选做）
使用 OpenCompass 评测 InternLM2-Chat-1.8B 模型使用 LMDeploy部署后在 ceval 数据集上的性能。（选做）

API 模式评测

OpenCompass 提供了 API 模式评测和本地直接评测两种方式。其中 API 模式评测针对那些以 API 服务形式部署的模型，而本地直接评测则面向那些可以获取到模型权重文件的情况。

配置环境

conda create -n opencompass python=3.10
conda activate opencompass

cd /root
git clone -b 0.3.3 https://github.com/open-compass/opencompass
cd opencompass
pip install -e .
pip install -r requirements.txt
pip install huggingface_hub==0.25.2
pip install importlib-metadata

配置模型

export INTERNLM_API_KEY=xxxxxxxxxxxxxxxxxxxxxxx # 填入你申请的 API Key
cd /root/opencompass/
touch opencompass/configs/models/openai/puyu_api.py

创建的模型配置文件完整路径是/opencompass/opencompass/configs/models/openai/puyu_api.py，内容如下：

import os
from opencompass.models import OpenAISDK


internlm_url = 'https://internlm-chat.intern-ai.org.cn/puyu/api/v1/' # 你前面获得的 api 服务地址
internlm_api_key = os.getenv('INTERNLM_API_KEY')

models = [
    dict(
        # abbr='internlm2.5-latest',
        type=OpenAISDK,
        path='internlm2.5-latest', # 请求服务时的 model name
        # 换成自己申请的APIkey
        key=internlm_api_key, # API key
        openai_api_base=internlm_url,