NachschlagenQuellenregister

Originalarbeiterreichbar

QLoRA: Efficient Finetuning of Quantized LLMs

arxiv.org (externe Seite)

Dettmers und Mitautoren verbinden am 23.05.2023 die grobe Speicherung der Gewichte mit dem Verfahren von LoRA. Damit passt die Anpassung eines sehr großen Modells auf eine einzelne Grafikkarte. Die Arbeit liefert die einzige Größenordnung des Themas, die sich auf eigene Hardware beziehen lässt.

geprüft 24.09.2026Archivfassung (externe Seite, web.archive.org)

Worauf sich diese Seite beruft, wörtlich, abgerufen am 06.08.2026:

  • finetune a 65B parameter model on a single 48GB GPUbestätigt 24.09.2026
  • while preserving full 16-bit finetuning task performancebestätigt 24.09.2026

Low-Rank Adaptation im GlossarQLoRA im Glossar02 Ein Modell auf eigene Daten abstimmen

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.