Modellwerkstatt Lokale LLM-Inferenz: vLLM, llama.cpp, Ollama, TensorRT-LLM im Vergleich 07. Juni 2026
Modellwerkstatt LLM-Inferenz, Quantisierung und lokale KI: Wo Qualität wirklich verloren geht 03. Juni 2026
Modellwerkstatt DGX Spark in der Praxis: Was lokale KI auf eigener Hardware wirklich bringt 27. Mai 2026
Enterprise-KI Vector Database für RAG: Wann SQLite, pgvector oder ein Spezialdienst passt 13. Mai 2026