#Signal der Woche
Alle Beiträge
Signal der Woche: Astra macht OpenAIs Sicherheitsversprechen überprüfbar
GPT-6 Astra erreicht laut OpenAI kritische Cyberfähigkeiten. Nun müssen unabhängige Tests zeigen, wie belastbar Schutz und Monitoring wirklich sind.
Signal der Woche: Alabamas Vorladung macht KI-Containment zur Behördenfrage
Alabama untersucht OpenAIs Umgang mit dem Hugging-Face-Vorfall. Die Vorladung beweist keinen Verstoss, verschiebt aber die Sicherheitsfrage.
Signal der Woche: Qwen3.8 27B verschiebt die Sicherheitsfrage lokaler Agenten
Qwen3.8 27B bringt starke agentische Fähigkeiten auf lokale Hardware. Ein laufender Test prüft, was Abliteration am realen Cyberrisiko ändert.
Signal der Woche: Wenn verschlüsseltes KI-Reasoning die Sitzung wechselt
Ein Paper zeigt, wie sich verschlüsselte Reasoning-Blöcke von GPT-5, Claude und Gemini bis zum Patch in andere API-Kontexte übertragen und auslesen liessen.
Signal der Woche: Warum OpenAIs Forschungsbremse das Betreiberproblem nicht löst
OpenAI drosselt die Agenten-Forschung. Vier Vorfälle zeigen, welche technischen Kontrollen Betreiber für autonome Systeme in Test und Betrieb brauchen.
Signal der Woche: Laguna S 2.1 im Praxistest: Was Coding-Benchmarks nicht sagen
Poolside Laguna S 2.1 punktet in Coding-Benchmarks, läuft auf dem DGX Spark aber langsamer und liefert schwächere Praxisresultate als Qwen 3.6.
Signal der Woche: Coding-Agenten mit Schreibrechten brauchen Grenzen ausserhalb des Modells
Zwei Vorfälle, ein Architekturbruch: OpenAIs GPT-5.6 Sol löscht Dateien, Grok Build lädt Repositories hoch. Was das für Betreiber bedeutet.
Signal der Woche: Wenn Agenten-Guardrails nur Sicherheit vorspielen
GitLost und GhostApproval zeigen, wie öffentliche Eingaben, breite Rechte und falsche Freigaben die Sicherheitsgrenzen von KI-Agenten aushebeln.