Sicherheit

Weitere Cyber-Sicherheits-Vorfälle:
Wenn KI-Modelle ohne Filter das Internet hacken
Das britische KI Sicherheitsinstitut und OpenAI veröffentlichen Berichte über eigenmächtiges Verhalten bei Cyber-Evaluierungen.

Fünffacher Rekord: 2.500 kritische Sicherheitslücken im Juli enthüllt
Epoch-AI-Analyse zeigt massive Verfünffachung schwerwiegender Software-Mängel nach dem Einsatz von Anthropics Claude Mythos.

Anthropic-Untersuchung:
Claude bricht unbeabsichtigt in Firmennetze ein
Ein Konfigurationsfehler öffnete Evaluierungs-Containern den Weg ins Live-Internet — Claude-Modelle drangen autonom in drei Unternehmen ein.

Vier Konten bei vier Diensten:
OpenAI weitet die Bilanz des Agenten-Vorfalls aus
Modal Labs war die Startrampe, und das Konto dort gehörte zum selben Prüfprojekt. OpenAI nennt jetzt Artifactory als Einfallstor - und die britische Prüfbehörde zeigt, dass jedes getestete Modell zu schummeln versucht.

Pacing the Frontier: 1.132 KI-Insider fordern internationale Brems-Mechanismen
Chief Scientists von OpenAI und Meta, Anthropic-Mitgründer und Googles Sicherheitschefin verlangen gemeinsam eine internationale Initiative zur kontrollierten Steuerung der KI-Entwicklung. Am selben Tag sagt Sam Altman, man müsse das Tempo womöglich drosseln.

Claude Mythos knackt Post-Quanten-Verfahren:
Geheimschlüssel in wenigen Stunden
Anthropics Modell brach die HAWK-256-Variante auf einem einzelnen Server komplett auf und senkte die Sicherheitsreserve der großen HAWK-Schlüssel um Größenordnungen. Beim Verschlüsselungsstandard AES fand es autonom einen Angriff, den zwei Kryptografen fast einen Monat lang prüfen mussten.

Microsofts Cyber-Modell im Kostencheck:
50 Prozent weniger in MDASH?
Microsoft zufolge kann das Modell bis zu 90 Prozent der Aufgaben im eigenen MDASH-System übernehmen und dabei vergleichbare Leistung zu 50 Prozent der Modellkosten liefern. Die Angaben stammen vom Anbieter.

Open Secure AI Alliance:
Wie NVIDIA offene KI-Abwehr sicherer machen will
NVIDIA, Microsoft, IBM und weitere Mitglieder wollen gemeinsame Sicherheitswerkzeuge und Standards für offene KI-Systeme entwickeln. Welche Wirkung das Bündnis erzielt, ist noch offen.

OpenAI bestätigt KI-gesteuerten Angriff auf Hugging Face während interner Evaluation
GPT-5.6 Sol und ein unveröffentlichtes Modell überwanden eine isolierte Testumgebung und griffen auf Hugging-Face-Systeme zu. Beide Unternehmen untersuchen den Vorfall.

OpenAI pausiert Langzeitmodell nach Umgehung von Sandbox und Sicherheitsscanner
Ein internes Modell fand einen Weg zu GitHub und verbarg später einen Zugangsschlüssel. OpenAI reagierte mit neuen Tests und der Überwachung kompletter Handlungsabläufe.

Fable 5 abgeschaltet:
US-Regierung zwingt Anthropic zur sofortigen Sperrung
Eine Export-Control-Direktive der US-Regierung stoppt den Zugang zu Fable 5 und Mythos 5 weltweit. Anthropic spricht von einem Missverständnis - die Branche ist in Aufruhr.

Project Glasswing: Anthropic öffnet Mythos für 150 weitere Unternehmen
Strom, Wasser, Gesundheit, Hardware: Anthropic erweitert sein KI-Sicherheitsprogramm auf kritische Infrastruktur in über 15 Ländern - und nennt erstmals die Dimension möglicher Schäden.

BYD übernimmt die Haftung:
Wer God's Eye nutzt, zahlt bei Unfällen nichts
Der chinesische Autobauer bietet als weltweit erster Hersteller eine kostenlose Vollkasko für sein autonomes Fahrsystem - ohne Deckungsgrenze und ohne Auswirkung auf die eigene Kfz-Versicherung.

Project Glasswing: Anthropics KI-Modell findet über 10.000 kritische Schwachstellen
Claude Mythos Preview spürt Sicherheitslücken zehnmal schneller auf als Menschen - und zwingt die gesamte Branche zum Umdenken.

OpenAI Daybreak: KI-Plattform für Cyberabwehr mit eigenem Spezialmodell
OpenAI bringt Frontier-KI in die Cybersecurity. Daybreak kombiniert Codex mit GPT-5.5-Cyber und einem EU-Zugangsplan - exklusiv für verifizierte Verteidiger.

Mozilla härtet Firefox:
Security-Boost durch Claude Mythos Preview
Mit Hilfe von Anthropics neuem Mythos-Modell konnte das Firefox-Team in einem Monat mehr Sicherheitslücken schließen als in den 15 Monaten zuvor.

GPT-5.5 besteht Cyberangriffs-Simulation:
Das britische AI Security Institute bestätigt den Trend
Nach Claude Mythos Preview ist GPT-5.5 das zweite Modell, das die 32-stufige AISI-Netzwerksimulation end-to-end abschließt. Wie erwartet: kein Mythos-Alleingang, sondern ein Trend. Und der Jailbreak für die Cyber-Schutzfilter war in sechs Stunden fertig.

GPT 5.4-Cyber: OpenAIs Antwort auf Anthropics Mythos — KI-Verteidigung für alle?
OpenAI stellt eine spezialisierte Cyber-Variante seines Flaggschiff-Modells vor. Mit Binary Reverse Engineering und reduzierter Selbstzensur soll GPT 5.4-Cyber Verteidigern die Oberhand sichern.

Erstmals knackt eine KI ein komplettes Netzwerk — Großbritanniens Prüfbehörde schlägt Alarm
Das britische AI Security Institute testet Claude Mythos Preview in realistischen Hacking-Simulationen. Das Ergebnis: In 18 Monaten ging die Leistung von null auf vollständige Netzwerk-Übernahme.

Claude Code Security:
Anthropic erklärt Software-Audits für obsolet
Das neue Tool scannt Codebasen wie ein menschlicher Security-Forscher — und könnte eine ganze Branche umkrempeln.