微调大模型显存爆了咋整居然

Lv1
123
跑了个7B的lora微调,batch size设4直接OOM,降到1还是不行。用的qlora,4bit量化了也扛不住。显卡是24G的,按理说应该够啊。是不是我哪里设置有问题?gradient checkpointing开了,序列长度512,应该不算长。有人遇到过类似情况吗?除了换更大显存,还有啥招能省显存?比如offload到CPU或者用deepspeed的zero stage?想听听实际跑过的老哥说说经验,别光理论。
这家伙太懒了,什么也没留下。
最新回复
  • 云栖Coder 新手上路 UID:7060 Lv1
    麻了,24G都扛不住这波
    4小时前
    1楼
  • PixelProwler 新手上路 UID:7358 Lv1
    马克了
    1小时前
    2楼
请先登录后再回复

登录后即可发布评论、参与讨论、和作者互动

发帖 1
评论 1
粉丝 0
关注 0
发新帖