跳到正文
原文
Hugging Face Blog·· 2023-03-09精選AI 評分75

在 24GB 消費級 GPU 上使用 RLHF 微調 20B 大語言模型

Fine-tuning 20B LLMs with RLHF on a 24GB consumer GPU

AI 導讀

Hugging Face 發佈 trl 與 peft 整合,介紹以 RLHF 在 24GB 消費級 GPU 上微調 20B 大語言模型的方法。示例以 gpt-neox-20b 為基礎,結合 8-bit 載入與 PEFT 低秩適配器,並透過停用適配器讓同一模型提供參考與當前 logits。

推薦理由

文章拆解 8-bit 載入、PEFT 低秩適配器與共用參考模型的組合,呈現降低 RLHF 微調大型模型顯存需求的實作思路。

來源:Hugging Face Blog · huggingface.co