跳到正文
千机 API
原文
Hugging Face Blog·· 2023-05-24

Hugging Face 集成 4-bit 模型支持并发布 QLoRA 微调方法

Making LLMs even more accessible with bitsandbytes, 4-bit quantization and QLoRA

AI 导读

Hugging Face 宣布与 bitsandbytes 合作,在 Transformers 中支持以 4-bit 精度加载模型,并通过 PEFT 在冻结的量化模型上训练适配器;纯 4-bit 训练并不支持,且该方法要求 GPU。同期发布的 QLoRA 论文报告称,可在单张 48GB GPU 上微调 65B 参数模型,并保持其所称的 16-bit 微调任务表现;博客还提供代码、模型和入门笔记本。

来源:Hugging Face Blog · huggingface.co