NachschlagenQuellenregister

Originalarbeiterreichbar

DeepSeek-V3 Technical Report

arxiv.org (externe Seite)

Der technische Bericht zu DeepSeek-V3 vom 27.12.2024 übernimmt die Vorhersage mehrerer Token als eigene Ausgabeköpfe (MTP-Module) auf einem gemeinsamen Modellrumpf und zeigt, dass sich dieselben Köpfe bei der Inferenz für das Speculative Decoding wiederverwenden lassen, mit einer im Bericht gemessenen Trefferquote von 85 bis 90 Prozent für den zweiten vorhergesagten Token.

geprüft 24.09.2026Archivfassung (externe Seite, web.archive.org)

Elf Wege, ein lokales Modell schneller zu machenMulti-Token Prediction im Glossar

Alle Quellen

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.