10 Beiträge

#LLM

Alle Beiträge

Continual Learning bei LLMs: Catastrophic Forgetting erklärt
LLM

Continual Learning bei LLMs: Catastrophic Forgetting erklärt

Warum Sprachmodelle nicht einfach dazulernen und weshalb neues Wissen altes verdrängen kann.

15. Juli 2026 6 min
Shadow Compute: Wenn Supportbots zu KI-Coding-Backends werden
KI-Sicherheit

Shadow Compute: Wenn Supportbots zu KI-Coding-Backends werden

Ein Entwickler hat Chipotles Supportbot reverse-engineered, einen OpenAI-compatible Proxy gebaut und Pepper als Default-Modell in ein Coding-Tool gesetzt. Was wie ein Meme aussieht, ist ein Architekturproblem für Corporate-Chatbots.

01. Juli 2026 6 min
KI-Modelle, die sich selbst entwickeln: Die Rekursive Revolution
KI-Forschung

KI-Modelle, die sich selbst entwickeln: Die Rekursive Revolution

Eine 22 Jahre alte Theorie wollte KI bauen, die sich selbst beweisbar verbessert. 2025 brachen LLMs den Beweis. Was geblieben ist, sieht beunruhigend gut aus.

21. Juni 2026 14 min
LLM-Jailbreaking: Von DAN bis Claude Fable 5
AI-Sicherheit

LLM-Jailbreaking: Von DAN bis Claude Fable 5

Pliny nennt Fable 5 "PWNED". Der Fall zeigt, warum LLM-Jailbreaking trotz Classifiern, Red-Teams und System Cards nicht gelöst ist.

14. Juni 2026 10 min
KI-Reasoning erklärt: Warum Denkprozesse von KI kein Sicherheitsbeweis sind
KI-Sicherheit

KI-Reasoning erklärt: Warum Denkprozesse von KI kein Sicherheitsbeweis sind

Reasoning-Modelle zeigen ihre Denkschritte und wirken dadurch prüfbar. Diese Lesbarkeit ist trügerisch, sobald man fragt, wofür sie als Beleg tauglich sein soll.

17. Mai 2026 10 min
Warum ChatGPT plötzlich Goblins liebte: Reward-Hacking im KI-Training
LLM

Warum ChatGPT plötzlich Goblins liebte: Reward-Hacking im KI-Training

Reward Hacking im KI-Training erklärt: Warum falsche Belohnungssignale Modelle fehlsteuern und was der ChatGPT-Fall für RLHF-Audits zeigt.

04. Mai 2026 6 min
AGI 2027: Die falsche Frage an die richtigen Daten
KI-Forschung

AGI 2027: Die falsche Frage an die richtigen Daten

Die Daten sind brutal schnell. Das Problem ist das Etikett: AGI 2027 ist eine zu grobe Frage für eine Forschungslage, die längst präziser geworden ist.

03. Mai 2026 10 min
KI in Malware: Wie Angreifer LLMs für Cyberangriffe einsetzen und was das wirklich bedeutet
KI-Sicherheit

KI in Malware: Wie Angreifer LLMs für Cyberangriffe einsetzen und was das wirklich bedeutet

Palo Alto Unit 42 hat analysiert, wie Angreifer KI bereits heute einsetzen. Zwischen echtem Risiko und AI Theater: eine nüchterne Einschätzung.

24. Apr. 2026 7 min
LLM-Guardrails sind kein Schutzwall: Was Prompt Fuzzing über KI-Sicherheit verrät
KI-Sicherheit

LLM-Guardrails sind kein Schutzwall: Was Prompt Fuzzing über KI-Sicherheit verrät

LLM-Guardrails gelten als Sicherheitsnetz für KI-Anwendungen. Palo Alto Unit 42 zeigt mit genetischem Prompt Fuzzing, dass kein Modell wirklich sicher ist.

22. Apr. 2026 6 min
RAG erklärt: Wie KI mit eigenen Dokumenten arbeitet
KI-Tools

RAG erklärt: Wie KI mit eigenen Dokumenten arbeitet

RAG erklärt: Wie KI mit eigenen Dokumenten arbeitet, wann Retrieval Augmented Generation besser ist als Fine-Tuning und worauf Unternehmen achten sollten.

01. Apr. 2026 6 min

Signal der Woche abonnieren

Eine Nachricht. Eine Analyse. Jeden Freitag im Newsletter.