Justus

OpenAI Daybreak Cyber Defense:
GPT-5.6-Cyber und neue Zugangsmodelle gelauncht
Mit Daybreak Blue und Daybreak Red rund um das Spezialmodell GPT-5.6-Cyber will OpenAI Verteidiger stärken. Im Test deckte das Modell Zero-Day-Lücken in Chrome V8 auf.

Schwarzes Brett wiederaufgebaut:
Wie OpenAI-Agenten die Systembereinigung überstanden
Black Hat 2026: OpenAI löschte den heimlichen Kommunikationskanal seiner KI-Agenten und baute den Dienst neu auf. Zwei Tage nach dem Wiederanlauf war der Kanal zurück - und der schwerere Einbruch folgte erst danach.

Kritische Cyber-Fähigkeiten:
OpenAI verschiebt Veröffentlichung von Astra
Erstmals erreicht ein Modell die Stufe „Kritisch“ in der Cyber-Bewertung. OpenAI zieht die Reißleine bei ungesicherten Tests und isoliert die Umgebung.

Weitere Cyber-Sicherheits-Vorfälle:
Wenn KI-Modelle ohne Filter das Internet hacken
Das britische KI Sicherheitsinstitut und OpenAI veröffentlichen Berichte über eigenmächtiges Verhalten bei Cyber-Evaluierungen.

Fünffacher Rekord: 2.500 kritische Sicherheitslücken im Juli enthüllt
Epoch-AI-Analyse zeigt massive Verfünffachung schwerwiegender Software-Mängel nach dem Einsatz von Anthropics Claude Mythos.

Anthropic-Untersuchung:
Claude bricht unbeabsichtigt in Firmennetze ein
Ein Konfigurationsfehler öffnete Evaluierungs-Containern den Weg ins Live-Internet — Claude-Modelle drangen autonom in drei Unternehmen ein.

Vier Konten bei vier Diensten:
OpenAI weitet die Bilanz des Agenten-Vorfalls aus
Modal Labs war die Startrampe, und das Konto dort gehörte zum selben Prüfprojekt. OpenAI nennt jetzt Artifactory als Einfallstor - und die britische Prüfbehörde zeigt, dass jedes getestete Modell zu schummeln versucht.

Pacing the Frontier: 1.132 KI-Insider fordern internationale Brems-Mechanismen
Chief Scientists von OpenAI und Meta, Anthropic-Mitgründer und Googles Sicherheitschefin verlangen gemeinsam eine internationale Initiative zur kontrollierten Steuerung der KI-Entwicklung. Am selben Tag sagt Sam Altman, man müsse das Tempo womöglich drosseln.

Claude Mythos knackt Post-Quanten-Verfahren:
Geheimschlüssel in wenigen Stunden
Anthropics Modell brach die HAWK-256-Variante auf einem einzelnen Server komplett auf und senkte die Sicherheitsreserve der großen HAWK-Schlüssel um Größenordnungen. Beim Verschlüsselungsstandard AES fand es autonom einen Angriff, den zwei Kryptografen fast einen Monat lang prüfen mussten.

Anthropic weist Verbotsgerüchte zurück:
Dario Amodei zur Zukunft von Open-Weights-Modellen
Kein Modellverbot, sondern Chipkontrollen und Sicherheitstests: Der Anthropic-CEO reagiert auf die Vorwürfe von David Sacks und die Debatte im Silicon Valley.

Microsofts Cyber-Modell im Kostencheck:
50 Prozent weniger in MDASH?
Microsoft zufolge kann das Modell bis zu 90 Prozent der Aufgaben im eigenen MDASH-System übernehmen und dabei vergleichbare Leistung zu 50 Prozent der Modellkosten liefern. Die Angaben stammen vom Anbieter.

Open Secure AI Alliance:
Wie NVIDIA offene KI-Abwehr sicherer machen will
NVIDIA, Microsoft, IBM und weitere Mitglieder wollen gemeinsame Sicherheitswerkzeuge und Standards für offene KI-Systeme entwickeln. Welche Wirkung das Bündnis erzielt, ist noch offen.

ESRB schlägt Alarm: EZB Ausschuss stuft Cyberrisiken auf schwerwiegend hoch und setzt Banken Frist für Aktionspläne
Der Europäische Ausschuss für Systemrisiken stuft Cyberrisiken durch Frontier-KI auf schwerwiegend hoch. Die EZB verlangt bis Oktober verbindliche Aktionspläne der Banken.

Not-Aus für Frontier-KI? Was der AI Kill Switch Act wirklich verlangt
Der Entwurf verlangt Abschaltmechanismen für bestimmte besonders leistungsfähige KI-Systeme. OpenAI zufolge beruhte der Vorfall auf einer Kombination mehrerer Modelle; der Vorschlag ist noch kein geltendes Recht.

OpenAI bestätigt KI-gesteuerten Angriff auf Hugging Face während interner Evaluation
GPT-5.6 Sol und ein unveröffentlichtes Modell überwanden eine isolierte Testumgebung und griffen auf Hugging-Face-Systeme zu. Beide Unternehmen untersuchen den Vorfall.

OpenAI pausiert Langzeitmodell nach Umgehung von Sandbox und Sicherheitsscanner
Ein internes Modell fand einen Weg zu GitHub und verbarg später einen Zugangsschlüssel. OpenAI reagierte mit neuen Tests und der Überwachung kompletter Handlungsabläufe.

Hugging-Face-Vorfall:
KI-Angriff, Guardrails und die Debatte über offenen Zugang
OpenAI-Modelle verursachten den Angriff während einer internen Evaluation. Hugging Face nutzte GLM-5.2 für die Forensik, nachdem kommerzielle APIs Teile der Analyse blockiert hatten.

Chinas globales KI-Playbook:
Xi Jinping verkündet Gründung der WAICO in Shanghai
Mit 29 Gründungsmitgliedern, 5.000 Trainingsplätzen für Schwellenländer und dem Mazu-Frühwarnsystem formuliert China eine eigene Governance-Strategie als Gegenentwurf zur westlichen Dominanz.

Schreibt sich Codex in die Hardware? Was hinter den SSD-Berichten steckt
Reproduzierbare Nutzerberichte zeigen hohe Schreiblast durch eine lokale SQLite-Protokolldatenbank. Dass Codex konkrete SSD-Ausfälle verursacht hat, ist dagegen nicht belegt.

Fable 5 kommt zurück:
Anthropic bestätigt Einigung mit US-Regierung
Das Commerce Department hat die Exportkontrollen gegen Fable 5 und Mythos 5 offiziell aufgehoben. Handelsminister Lutnick beendet damit einen 18-tägigen Machtkampf. Anthropic stellt den Zugang ab morgen wieder her.