5 Beiträge

#Model Lab

Alle Beiträge

Qwen3.8 auf DGX Spark: Warum NVFP4 MTP3 mein Produktionsprofil ist
Model Lab

Qwen3.8 auf DGX Spark: Warum NVFP4 MTP3 mein Produktionsprofil ist

NVFP4 mit MTP3 läuft auf meiner DGX Spark als Produktionsprofil: 262.144 Tokens Kontext, auditierter Tool-Score 91 und stabiler Parallelbetrieb mit Embedding und TTS.

16. Aug. 2026 6 min
MiniMax H3 auf DGX Spark: Viermal schneller, aber nicht derselbe Output
KI-Infrastruktur

MiniMax H3 auf DGX Spark: Viermal schneller, aber nicht derselbe Output

Derselbe Fuchs braucht knapp drei oder fast 45 Minuten. Der schnellste Clip ist trotzdem nicht derjenige, den ich behalten würde.

11. Aug. 2026 7 min
Qwen auf dem DGX Spark optimieren: 20 Prozent mehr Durchsatz mit MTP1
Model Lab

Qwen auf dem DGX Spark optimieren: 20 Prozent mehr Durchsatz mit MTP1

Wie MTP1 den Decode-Throughput des Qwen3.6-35B-FP8-Modells auf DGX Spark um 20 Prozent steigert und welche Grenzen Produktionsfixtures zeigen. Inklusive Recipe.

19. Juli 2026 8 min
GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen
Local AI

GGUF erklärt: Warum lokale KI-Modelle dieses Format nutzen

GGUF ist das pragmatische Deployment-Format lokaler KI-Modelle. Wir zeigen, welche Quantisierung auf welcher Hardware sinnvoll ist und was das Format wirklich leistet.

08. Juli 2026 8 min
Ideogram 4 auf DGX Spark: Schöne Bilder, falsche Hardware
KI-Infrastruktur

Ideogram 4 auf DGX Spark: Schöne Bilder, falsche Hardware

Ideogram 4 kann auf DGX Spark schöne Bilder erzeugen. Der Benchmark zeigt trotzdem: Für lokale Bild-KI ist Spark technisch spannend, aber praktisch die falsche Hardware.

07. Juli 2026 8 min
AISyndicate

Kostenlos weiterlesen.

Erhalte Zugang zu den Mitgliederartikeln. Werbefrei, ohne Sales Funnel und ohne Verkaufsmails.

Kostenlos. Keine Werbung. Jederzeit abmelden.