Hugging Face Blog·· 2023-03-09精選AI 評分75
在 24GB 消費級 GPU 上使用 RLHF 微調 20B 大語言模型
Fine-tuning 20B LLMs with RLHF on a 24GB consumer GPU
AI 導讀
Hugging Face 發佈 trl 與 peft 整合,介紹以 RLHF 在 24GB 消費級 GPU 上微調 20B 大語言模型的方法。示例以 gpt-neox-20b 為基礎,結合 8-bit 載入與 PEFT 低秩適配器,並透過停用適配器讓同一模型提供參考與當前 logits。
推薦理由
文章拆解 8-bit 載入、PEFT 低秩適配器與共用參考模型的組合,呈現降低 RLHF 微調大型模型顯存需求的實作思路。
來源:Hugging Face Blog · huggingface.co