#Hardware
Alle Beiträge
284B in 2 Bit auf 128 GB: DeepSeek V4 Flash mit 20 tok/s
DeepSeek V4 Flash mit 284 Milliarden Parametern lief in einer 2-Bit-Quantisierung auf einer einzelnen NVIDIA DGX Spark. Der Labortest erreichte 20 Token pro Sekunde und 81 von 100 im Tool-Eval-Hardmode.
FP4 auf Blackwell: Was NVFP4 für lokale KI wirklich ändert
NVFP4 macht FP4 auf Blackwell erstmals praktisch relevant. Entscheidend sind Scaling, Layer-Profil und Deployment-Disziplin.
DeepSeek V4-Pro und Flash: API, Preise und lokale Hardware
DeepSeek V4-Pro, Flash und Vision-Exp im aktuellen Vergleich: API-Unterschiede, Preise, Thinking-Fallen und was lokal tatsächlich läuft.
Ollama auf dem Mac Mini: Welche Modelle auf welcher Ausstattung sinnvoll laufen
Der Mac mini ist ein starker lokaler KI-Rechner, wenn Speicher, Modell und Runtime zusammenpassen. Seit dem MLX-Start hat sich die Kaufentscheidung verschoben.
KI-Urteil der Woche: Vera Rubin setzt den Takt
KI-Urteil der Woche zu Nvidias Vera-Rubin-Wette: Warum die Plattform Cloud-Kosten senken und DACH-Rechenzentren neu takten könnte.
Nvidia GTC 2026: Vera Rubin, CUDA 20 und die KI-Roadmap
Nvidia GTC 2026 erklärt: Vera Rubin, CUDA 20, Inference-Markt, DLSS 5 und was die Roadmap für Entwickler und DACH-Unternehmen bedeutet.
OpenClaw auf Raspberry Pi: Setup, Sicherheit und drei Monate Erfahrung
OpenClaw auf dem Raspberry Pi läuft schnell. Schwierig wird der dauerhafte Betrieb: Node-Versionen, systemd, Tailscale, Rechte, Logs und Wartung entscheiden.
OpenAI eigene Chips: Codex-Spark läuft ohne Nvidia
OpenAI nutzt eigene Chips von Cerebras für Codex-Spark – 1.000 Tokens pro Sekunde, kein Nvidia nötig. Was das für die KI-Industrie bedeutet.