#Model Lab
Alle Beiträge
Qwen3.8 auf DGX Spark: Warum NVFP4 MTP3 mein Produktionsprofil ist
NVFP4 mit MTP3 läuft auf meiner DGX Spark als Produktionsprofil: 262.144 Tokens Kontext, auditierter Tool-Score 91 und stabiler Parallelbetrieb mit Embedding und TTS.
MiniMax H3 auf DGX Spark: Viermal schneller, aber nicht derselbe Output
Derselbe Fuchs braucht knapp drei oder fast 45 Minuten. Der schnellste Clip ist trotzdem nicht derjenige, den ich behalten würde.
Qwen auf dem DGX Spark optimieren: 20 Prozent mehr Durchsatz mit MTP1
Wie MTP1 den Decode-Throughput des Qwen3.6-35B-FP8-Modells auf DGX Spark um 20 Prozent steigert und welche Grenzen Produktionsfixtures zeigen. Inklusive Recipe.
GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen
GGUF ist das pragmatische Deployment-Format lokaler KI-Modelle. Wir zeigen, welche Quantisierung auf welcher Hardware sinnvoll ist und was das Format wirklich leistet.
Ideogram 4 auf DGX Spark: Schöne Bilder, falsche Hardware
Ideogram 4 kann auf DGX Spark schöne Bilder erzeugen. Der Benchmark zeigt trotzdem: Für lokale Bild-KI ist Spark technisch spannend, aber praktisch die falsche Hardware.