2 Beiträge

#Local AI

Alle Beiträge

Qwen auf dem DGX Spark optimieren: 20 Prozent mehr Durchsatz mit MTP1
Model Lab

Qwen auf dem DGX Spark optimieren: 20 Prozent mehr Durchsatz mit MTP1

Wie MTP1 den Decode-Throughput des Qwen3.6-35B-FP8-Modells auf DGX Spark um 20 Prozent steigert und welche Grenzen Produktionsfixtures zeigen. Inklusive Recipe.

19. Juli 2026 8 min
GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen
Local AI

GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen

GGUF ist das pragmatische Deployment-Format lokaler KI-Modelle. Wir zeigen, welche Quantisierung auf welcher Hardware sinnvoll ist und was das Format wirklich leistet.

08. Juli 2026 8 min
AISyndicate

Kostenlos weiterlesen.

Erhalte Zugang zu den Mitgliederartikeln. Werbefrei, ohne Sales Funnel und ohne Verkaufsmails.

Kostenlos. Keine Werbung. Jederzeit abmelden.