Originalarbeiterreichbar
QLoRA: Efficient Finetuning of Quantized LLMs
Dettmers und Mitautoren verbinden am 23.05.2023 die grobe Speicherung der Gewichte mit dem Verfahren von LoRA. Damit passt die Anpassung eines sehr großen Modells auf eine einzelne Grafikkarte. Die Arbeit liefert die einzige Größenordnung des Themas, die sich auf eigene Hardware beziehen lässt.
geprüft 24.09.2026Archivfassung (externe Seite, web.archive.org)
Worauf sich diese Seite beruft, wörtlich, abgerufen am 06.08.2026:
finetune a 65B parameter model on a single 48GB GPU
bestätigt 24.09.2026while preserving full 16-bit finetuning task performance
bestätigt 24.09.2026
Low-Rank Adaptation im GlossarQLoRA im Glossar02 Ein Modell auf eigene Daten abstimmen