书生浦语大模型实战营第三期 L2 InternVL 多模态模型部署微调实践

YZBshanshan

已于 2024-08-20 11:08:03 修改

阅读量307

点赞数 7

分类专栏：书生浦语大模型实战营第三期文章标签：学习笔记

于 2024-08-20 11:06:00 首次发布

本文链接：https://blog.youkuaiyun.com/yizhiboshanshan/article/details/141326147

版权

1. InternVL 模型总览

2. 环境部署

conda create --name xtuner python=3.10 -y

# 激活虚拟环境（注意：后续的所有操作都需要在这个虚拟环境中进行）
conda activate xtuner

# 安装一些必要的库
conda install pytorch==2.1.2 torchvision==0.16.2 torchaudio==2.1.2 pytorch-cuda=12.1 -c pytorch -c nvidia -y
# 安装其他依赖
apt install libaio-dev
pip install transformers==4.39.3
pip install streamlit==1.36.0
pip install flash_attn

安装xtuner v0.1.23

# 创建一个目录，用来存放源代码
mkdir -p /root/InternLM/code
cd /root/InternLM/code
git clone -b v0.1.23  https://github.com/InternLM/XTuner
cd /root/InternLM/code/XTuner
pip install -e '.[deepspeed]'

安装LMDeploy

pip install lmdeploy==0.5.3

验证安装情况

xtuner version

3. 准备微调数据集

使用huggingface上的zhongshsh/CLoT-Oogiri-GO数据集，已经在开发机的共享空间中了：

## 首先安装一下需要的包
pip install datasets matplotlib Pillow timm

## 把数据集挪出来
cp -r /root/share/new_models/datasets/CLoT_cn_2000 /root/InternLM/datasets/

4. 开始微调

修改配置文件

XTuner下 InternVL的config，文件在：/root/InternLM/code/XTuner/xtuner/configs/internvl/v2/internvl_v2_internlm2_2b_qlora_finetune.py，修改以后如下：

# Copyright (c) OpenMMLab. All rights reserved.
from mmengine.hooks import (CheckpointHook, DistSamplerSeedHook, IterTimerHook,
                            LoggerHook, ParamSchedulerHook)
from mmengine.optim import AmpOptimWrapper, CosineAnnealingLR, LinearLR
from peft import LoraConfig
from torch.optim import AdamW
from transformers import AutoTokenizer

from xtuner.dataset import InternVL_V1_5_Dataset
from xtun

最低0.47元/天解锁文章