Modellwerkstatt Lokale LLM-Inferenz: vLLM, llama.cpp, Ollama, TensorRT-LLM im Vergleich 07. Juni 2026
Modellwerkstatt LLM-Inferenz, Quantisierung und lokale KI: Wo Qualität wirklich verloren geht 03. Juni 2026
Modellwerkstatt DGX Spark in der Praxis: Was lokale KI auf eigener Hardware wirklich bringt 27. Mai 2026
Modellwerkstatt Ollama auf dem Mac Mini: Welche Modelle auf welcher Ausstattung sinnvoll laufen 06. Apr. 2026