8 Beiträge

#Hardware

Alle Beiträge

284B in 2 Bit auf 128 GB: DeepSeek V4 Flash mit 20 tok/s
Sprachmodelle

284B in 2 Bit auf 128 GB: DeepSeek V4 Flash mit 20 tok/s

DeepSeek V4 Flash mit 284 Milliarden Parametern lief in einer 2-Bit-Quantisierung auf einer einzelnen NVIDIA DGX Spark. Der Labortest erreichte 20 Token pro Sekunde und 81 von 100 im Tool-Eval-Hardmode.

05. Aug. 2026 6 min
FP4 auf Blackwell: Was NVFP4 für lokale KI wirklich ändert
Lokale KI

FP4 auf Blackwell: Was NVFP4 für lokale KI wirklich ändert

NVFP4 macht FP4 auf Blackwell erstmals praktisch relevant. Entscheidend sind Scaling, Layer-Profil und Deployment-Disziplin.

03. Juni 2026 9 min
DeepSeek V4-Pro und Flash: API, Preise und lokale Hardware
Sprachmodelle

DeepSeek V4-Pro und Flash: API, Preise und lokale Hardware

DeepSeek V4-Pro, Flash und Vision-Exp im aktuellen Vergleich: API-Unterschiede, Preise, Thinking-Fallen und was lokal tatsächlich läuft.

26. Mai 2026 5 min
Ollama auf dem Mac Mini: Welche Modelle auf welcher Ausstattung sinnvoll laufen
Open-Source-KI

Ollama auf dem Mac Mini: Welche Modelle auf welcher Ausstattung sinnvoll laufen

Der Mac mini ist ein starker lokaler KI-Rechner, wenn Speicher, Modell und Runtime zusammenpassen. Seit dem MLX-Start hat sich die Kaufentscheidung verschoben.

06. Apr. 2026 6 min
KI-Urteil der Woche: Vera Rubin setzt den Takt
KI-Urteil

KI-Urteil der Woche: Vera Rubin setzt den Takt

KI-Urteil der Woche zu Nvidias Vera-Rubin-Wette: Warum die Plattform Cloud-Kosten senken und DACH-Rechenzentren neu takten könnte.

20. März 2026 3 min
Nvidia GTC 2026: Vera Rubin, CUDA 20 und die KI-Roadmap
Hardware

Nvidia GTC 2026: Vera Rubin, CUDA 20 und die KI-Roadmap

Nvidia GTC 2026 erklärt: Vera Rubin, CUDA 20, Inference-Markt, DLSS 5 und was die Roadmap für Entwickler und DACH-Unternehmen bedeutet.

18. März 2026 6 min
OpenClaw auf Raspberry Pi: Setup, Sicherheit und drei Monate Erfahrung
Hardware

OpenClaw auf Raspberry Pi: Setup, Sicherheit und drei Monate Erfahrung

OpenClaw auf dem Raspberry Pi läuft schnell. Schwierig wird der dauerhafte Betrieb: Node-Versionen, systemd, Tailscale, Rechte, Logs und Wartung entscheiden.

09. März 2026 6 min
OpenAI eigene Chips: Codex-Spark läuft ohne Nvidia
Hardware

OpenAI eigene Chips: Codex-Spark läuft ohne Nvidia

OpenAI nutzt eigene Chips von Cerebras für Codex-Spark – 1.000 Tokens pro Sekunde, kein Nvidia nötig. Was das für die KI-Industrie bedeutet.

05. März 2026 3 min
AISyndicate

Kostenlos weiterlesen.

Erhalte Zugang zu den Mitgliederartikeln. Werbefrei, ohne Sales Funnel und ohne Verkaufsmails.

Kostenlos. Keine Werbung. Jederzeit abmelden.