12 Beiträge

#Sprachmodelle

Alle Beiträge

284B in 2 Bit auf 128 GB: DeepSeek V4 Flash mit 20 tok/s
Sprachmodelle

284B in 2 Bit auf 128 GB: DeepSeek V4 Flash mit 20 tok/s

DeepSeek V4 Flash mit 284 Milliarden Parametern lief in einer 2-Bit-Quantisierung auf einer einzelnen NVIDIA DGX Spark. Der Labortest erreichte 20 Token pro Sekunde und 81 von 100 im Tool-Eval-Hardmode.

05. Aug. 2026 6 min
DeepSeek V4-Pro und Flash: API, Preise und lokale Hardware
Sprachmodelle

DeepSeek V4-Pro und Flash: API, Preise und lokale Hardware

DeepSeek V4-Pro, Flash und Vision-Exp im aktuellen Vergleich: API-Unterschiede, Preise, Thinking-Fallen und was lokal tatsächlich läuft.

26. Mai 2026 5 min
Vector Database für RAG: Wann SQLite, pgvector oder ein Spezialdienst passt
KI-Infrastruktur

Vector Database für RAG: Wann SQLite, pgvector oder ein Spezialdienst passt

Eine Vector Database ist keine Pflicht für RAG. Entscheidend sind Korpus, Filter, Lastprofil und die Frage, ob eine einfachere Suche das Problem bereits löst.

13. Mai 2026 7 min
Open-Source-KI-Modelle vs. APIs: Wann sich lokaler Betrieb lohnt
Open-Source-KI

Open-Source-KI-Modelle vs. APIs: Wann sich lokaler Betrieb lohnt

Open-Source-KI-Modelle, offene Gewichte und proprietäre APIs klingen wie eine Familie. Sind sie nicht. Wer die Begriffe verwechselt, trifft die falsche Betriebsentscheidung.

15. Apr. 2026 8 min
Vom ML-Engineering zum AI-Engineering: Ein Paradigmenwechsel
KI-Coding

Vom ML-Engineering zum AI-Engineering: Ein Paradigmenwechsel

ML Engineers bauen Modelle. AI Engineers bauen darauf Anwendungen. Der Unterschied klingt simpel, hat aber massive Konsequenzen für Skills, Teams und Karrierewege. Was 2026 zählt und wo die Reise hingeht.

08. Apr. 2026 6 min
Ollama auf dem Mac Mini: Welche Modelle auf welcher Ausstattung sinnvoll laufen
Open-Source-KI

Ollama auf dem Mac Mini: Welche Modelle auf welcher Ausstattung sinnvoll laufen

Der Mac mini ist ein starker lokaler KI-Rechner, wenn Speicher, Modell und Runtime zusammenpassen. Seit dem MLX-Start hat sich die Kaufentscheidung verschoben.

06. Apr. 2026 6 min
RAG erklärt: Wann KI mit eigenen Dokumenten wirklich besser antwortet
KI-Tools

RAG erklärt: Wann KI mit eigenen Dokumenten wirklich besser antwortet

Ein Ordner voller PDFs macht noch kein Wissenssystem. RAG lohnt sich erst, wenn Suche, Rechte, Aktualität und Quellenbezug gemeinsam funktionieren.

01. Apr. 2026 7 min
Qwen-Modelle 2026: Qwen3.8, API, VRAM und RAG
Open-Source-KI

Qwen-Modelle 2026: Qwen3.8, API, VRAM und RAG

Qwen3.8-27B erreicht Frontier-nahe Benchmarks und läuft lokal oder per API. Der aktualisierte Guide vergleicht Qualität, VRAM, Qwen3.6, Coder-Next und RAG.

16. März 2026 8 min
KI-Bewusstsein: Was die Forschung 2026 wirklich weiss
KI-Forschung

KI-Bewusstsein: Was die Forschung 2026 wirklich weiss

Experimente messen Selbstberichte, Unsicherheitsbewertung und Metakognition bei LLMs. Was sagt das 2026 tatsächlich über KI-Bewusstsein aus?

15. März 2026 7 min
GPT-5.4 ist da: OpenAI launcht sein stärkstes Modell – mit Thinking, Pro und Computer Use
KI-News

GPT-5.4 ist da: OpenAI launcht sein stärkstes Modell – mit Thinking, Pro und Computer Use

OpenAI hat GPT-5.4 offiziell veröffentlicht – das Modell vereint Coding, extremes Reasoning und Computer Use. Was wir jetzt wissen, und was der Leak von gestern bereits vorweggenommen hat.

06. März 2026 2 min
GPT-5.4 Leak: Extremes Reasoning, stundenlange Aufgaben und doppelter Kontext
KI-News

GPT-5.4 Leak: Extremes Reasoning, stundenlange Aufgaben und doppelter Kontext

GPT-5.4 soll laut Leak ein 1-Millionen-Token-Kontextfenster, einen extremen Reasoning-Modus und zuverlässige Leistung bei mehrstündigen Aufgaben mitbringen. Was bisher bekannt ist.

05. März 2026 4 min
Drei neue KI-Modelle gleichzeitig: GPT, Gemini, Claude
KI-News

Drei neue KI-Modelle gleichzeitig: GPT, Gemini, Claude

OpenAI, Google und Anthropic veröffentlichen heute gleichzeitig neue Frontier-Modelle. Was steckt dahinter – und welches ist das Richtige für dich?

04. März 2026 2 min
AISyndicate

Kostenlos weiterlesen.

Erhalte Zugang zu den Mitgliederartikeln. Werbefrei, ohne Sales Funnel und ohne Verkaufsmails.

Kostenlos. Keine Werbung. Jederzeit abmelden.