3 Beiträge

#Quantisierung

Alle Beiträge

GPTQ vs AWQ: Welche 4-Bit-Quantisierung ist besser für lokale LLMs?
Quantisierung

GPTQ vs AWQ: Welche 4-Bit-Quantisierung ist besser für lokale LLMs?

Wer GPTQ gegen AWQ abwägt, stellt die falsche Frage. Was den Throughput wirklich entscheidet, ist weder Algorithmus noch Modell.

22. Juli 2026 6 min
GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen
Local AI

GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen

GGUF ist das pragmatische Deployment-Format lokaler KI-Modelle. Wir zeigen, welche Quantisierung auf welcher Hardware sinnvoll ist und was das Format wirklich leistet.

08. Juli 2026 8 min
FP4 auf Blackwell: Was NVFP4 für lokale KI wirklich ändert
Lokale KI

FP4 auf Blackwell: Was NVFP4 für lokale KI wirklich ändert

NVFP4 macht FP4 auf Blackwell erstmals praktisch relevant. Entscheidend sind Scaling, Layer-Profil und Deployment-Disziplin.

03. Juni 2026 9 min
AISyndicate

Kostenlos weiterlesen.

Erhalte Zugang zu den Mitgliederartikeln. Werbefrei, ohne Sales Funnel und ohne Verkaufsmails.

Kostenlos. Keine Werbung. Jederzeit abmelden.