Originalarbeiterreichbar
llama.cpp, die README am Tag der Veröffentlichung
Der Stand vom 10.03.2023, festgehalten über den Commit. Er nennt das Ziel in einem Satz, das Verfahren (4 Bit, reines C und C++, Rechnung auf der CPU) und die Umstände der Entstehung. Der Permalink zeigt auf diesen Stand, nicht auf die heutige Fassung.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 29.07.2026:
The main goal is to run the model using 4-bit quantization on a MacBook
bestätigt 24.09.2026This was hacked in an evening
bestätigt 24.09.2026
KI-GeschichteElf Wege, ein lokales Modell schneller zu machenGGUF im GlossarQuantisierung im Glossar