Originalarbeiterreichbar
DeepSeek-V3 Technical Report
Der technische Bericht zu DeepSeek-V3 vom 27.12.2024 übernimmt die Vorhersage mehrerer Token als eigene Ausgabeköpfe (MTP-Module) auf einem gemeinsamen Modellrumpf und zeigt, dass sich dieselben Köpfe bei der Inferenz für das Speculative Decoding wiederverwenden lassen, mit einer im Bericht gemessenen Trefferquote von 85 bis 90 Prozent für den zweiten vorhergesagten Token.
geprüft 24.09.2026Archivfassung (externe Seite, web.archive.org)
Elf Wege, ein lokales Modell schneller zu machenMulti-Token Prediction im Glossar