Technologie
Lokale KI schneller machen: So zünden Sie den LLM-Turbo
Ein technischer Kniff bei lokalen LLMs kann die Generierungsrate massiv erhöhen: die Multi Token Prediction. Wir haben getestet, wie sie LLMs beschleunigt.
Schlagzeilen quer durchs Spektrum
- «Lokale KI schneller machen: So zünden Sie den LLM-Turbo» — Heise Online (mitte)