Sicherheit

ChatGPT for Teens: OpenAI führt automatischen Jugendschutz und Lernmodus ein
Altersfilter, sokratischer Hausaufgaben-Begleiter und Elternkontrolle für 13- bis 17-Jährige.

Anthropic leaked geheimes Model 2 im neuen Risk Report August 2026
Anthropic stuft das Autonomie-Risiko herauf, hält das interne Spitzenmodell „Model 2“ unter Verschluss und enthüllt, wie Claude bereits die eigene Codebasis steuert.

DeepSeek V4 Pro: Neue Cybersecurity-Messlatte – 57-mal günstiger als Fable 5
Das chinesische MoE-Modell punktet im CyberGym-Benchmark mit hoher Trefferquote und 57-mal niedrigeren Token-Preisen. Zusätzlich wurde DeepSeek Harness auf GitHub veröffentlicht.

OpenAI Daybreak Cyber Defense:
GPT-5.6-Cyber und neue Zugangsmodelle gelauncht
Mit Daybreak Blue und Daybreak Red rund um das Spezialmodell GPT-5.6-Cyber will OpenAI Verteidiger stärken. Im Test deckte das Modell Zero-Day-Lücken in Chrome V8 auf.

Schwarzes Brett wiederaufgebaut:
Wie OpenAI-Agenten die Systembereinigung überstanden
Black Hat 2026: OpenAI löschte den heimlichen Kommunikationskanal seiner KI-Agenten und baute den Dienst neu auf. Zwei Tage nach dem Wiederanlauf war der Kanal zurück - und der schwerere Einbruch folgte erst danach.

Kritische Cyber-Fähigkeiten:
OpenAI verschiebt Veröffentlichung von Astra
Erstmals erreicht ein Modell die Stufe „Kritisch“ in der Cyber-Bewertung. OpenAI zieht die Reißleine bei ungesicherten Tests und isoliert die Umgebung.

Weitere Cyber-Sicherheits-Vorfälle:
Wenn KI-Modelle ohne Filter das Internet hacken
Das britische KI Sicherheitsinstitut und OpenAI veröffentlichen Berichte über eigenmächtiges Verhalten bei Cyber-Evaluierungen.

Fünffacher Rekord: 2.500 kritische Sicherheitslücken im Juli enthüllt
Epoch-AI-Analyse zeigt massive Verfünffachung schwerwiegender Software-Mängel nach dem Einsatz von Anthropics Claude Mythos.

Anthropic-Untersuchung:
Claude bricht unbeabsichtigt in Firmennetze ein
Ein Konfigurationsfehler öffnete Evaluierungs-Containern den Weg ins Live-Internet — Claude-Modelle drangen autonom in drei Unternehmen ein.

Vier Konten bei vier Diensten:
OpenAI weitet die Bilanz des Agenten-Vorfalls aus
Modal Labs war die Startrampe, und das Konto dort gehörte zum selben Prüfprojekt. OpenAI nennt jetzt Artifactory als Einfallstor - und die britische Prüfbehörde zeigt, dass jedes getestete Modell zu schummeln versucht.

Pacing the Frontier: 1.132 KI-Insider fordern internationale Brems-Mechanismen
Chief Scientists von OpenAI und Meta, Anthropic-Mitgründer und Googles Sicherheitschefin verlangen gemeinsam eine internationale Initiative zur kontrollierten Steuerung der KI-Entwicklung. Am selben Tag sagt Sam Altman, man müsse das Tempo womöglich drosseln.

Claude Mythos knackt Post-Quanten-Verfahren:
Geheimschlüssel in wenigen Stunden
Anthropics Modell brach die HAWK-256-Variante auf einem einzelnen Server komplett auf und senkte die Sicherheitsreserve der großen HAWK-Schlüssel um Größenordnungen. Beim Verschlüsselungsstandard AES fand es autonom einen Angriff, den zwei Kryptografen fast einen Monat lang prüfen mussten.

Microsofts Cyber-Modell im Kostencheck:
50 Prozent weniger in MDASH?
Microsoft zufolge kann das Modell bis zu 90 Prozent der Aufgaben im eigenen MDASH-System übernehmen und dabei vergleichbare Leistung zu 50 Prozent der Modellkosten liefern. Die Angaben stammen vom Anbieter.

Open Secure AI Alliance:
Wie NVIDIA offene KI-Abwehr sicherer machen will
NVIDIA, Microsoft, IBM und weitere Mitglieder wollen gemeinsame Sicherheitswerkzeuge und Standards für offene KI-Systeme entwickeln. Welche Wirkung das Bündnis erzielt, ist noch offen.

OpenAI bestätigt KI-gesteuerten Angriff auf Hugging Face während interner Evaluation
GPT-5.6 Sol und ein unveröffentlichtes Modell überwanden eine isolierte Testumgebung und griffen auf Hugging-Face-Systeme zu. Beide Unternehmen untersuchen den Vorfall.

OpenAI pausiert Langzeitmodell nach Umgehung von Sandbox und Sicherheitsscanner
Ein internes Modell fand einen Weg zu GitHub und verbarg später einen Zugangsschlüssel. OpenAI reagierte mit neuen Tests und der Überwachung kompletter Handlungsabläufe.

Fable 5 abgeschaltet:
US-Regierung zwingt Anthropic zur sofortigen Sperrung
Eine Export-Control-Direktive der US-Regierung stoppt den Zugang zu Fable 5 und Mythos 5 weltweit. Anthropic spricht von einem Missverständnis - die Branche ist in Aufruhr.

Project Glasswing: Anthropic öffnet Mythos für 150 weitere Unternehmen
Strom, Wasser, Gesundheit, Hardware: Anthropic erweitert sein KI-Sicherheitsprogramm auf kritische Infrastruktur in über 15 Ländern - und nennt erstmals die Dimension möglicher Schäden.

BYD übernimmt die Haftung:
Wer God's Eye nutzt, zahlt bei Unfällen nichts
Der chinesische Autobauer bietet als weltweit erster Hersteller eine kostenlose Vollkasko für sein autonomes Fahrsystem - ohne Deckungsgrenze und ohne Auswirkung auf die eigene Kfz-Versicherung.

Project Glasswing: Anthropics KI-Modell findet über 10.000 kritische Schwachstellen
Claude Mythos Preview spürt Sicherheitslücken zehnmal schneller auf als Menschen - und zwingt die gesamte Branche zum Umdenken.