Microsoft hat mit MAI-Cyber-1-Flash sein erstes eigenes Spezialmodell für die Erkennung und Analyse von Software-Schwachstellen vorgestellt. Die Ankündigung erschien am selben Tag wie die Open Secure AI Alliance; eine direkte ursächliche Verbindung beider Mitteilungen ist nicht dokumentiert.
Das neue Modell ist Teil einer gestaffelten Infrastruktur, mit der Microsoft die Modellkosten automatisierter Sicherheitsanalysen senken will. Statt große Allround-Modelle für jede Aufgabe einzusetzen, kombiniert MDASH ein spezialisiertes Modell mit leistungsfähigeren Modellen für schwierigere Fälle.
Das MDASH-Framework: Agenten im kollaborativen Sicherheitscheck
Die technische Basis für den Einsatz bildet das sogenannte MDASH (Microsoft Security Multi-Model Agentic Scanning Harness). In diesem System arbeiten mehrere KI-Modelle nach dem Prinzip „Discover, Debate, Prove“ zusammen, um potenzielle Sicherheitslücken im Quellcode zu identifizieren, gegenseitig zu hinterfragen und deren Ausnutzbarkeit nachzuweisen.
- Aufteilung der Rechenlast: MAI-Cyber-1-Flash bearbeitet laut Microsoft bis zu 90 Prozent der MDASH-Aufgaben.
- Kostenvergleich: Microsoft gibt an, dass die Kombination innerhalb von MDASH eine vergleichbare Leistung zu 50 Prozent der Modellkosten führender Alternativen erreiche. Das ist keine Halbierung sämtlicher Kosten einer Sicherheitsabteilung.
- Modelle für schwierige Fälle: Anspruchsvollere Aufgaben können an größere Modelle wie GPT-5.4 weitergereicht werden.
Spitzenwerte im CyberGym-Benchmark
Im CyberGym-Benchmark, der die Erzeugung funktionierender Machbarkeitsnachweise für bekannte Schwachstellen testet, weist Microsoft für die Kombination aus MDASH und MAI-Cyber-1-Flash rund 96 Prozent aus. Nach Unternehmensangaben liegt das Ergebnis in diesem Test vor den verglichenen Systemen von Anthropic, Google und OpenAI. Der Benchmark misst nicht jede Form von Schwachstellensuche oder Patchqualität.
Die Ankündigung fällt in eine Phase wachsender Aufmerksamkeit für KI-gestützte Angriffe und Vorfälle wie die Kompromittierung bei Hugging Face. Die geprüfte Microsoft-Modellseite stellt jedoch keine direkte Kausalität zwischen diesem Vorfall und der Entwicklung von MAI-Cyber-1-Flash her.
Project Perception startet im August
Neben dem Modell und dem Scanning-Harness kündigte Microsoft mit Project Perception ein übergeordnetes System für agentische Sicherheit an. Nach Angaben des Unternehmens soll es spezialisierte Agenten für Überwachung, Schwachstellen-Patching und Bedrohungskontrollen koordinieren. Die erste öffentliche Testphase (Public Preview) ist für den 3. August 2026 angesetzt.
🎯 Was das für die Praxis bedeutet
1. Multi-Modell-Scans etablieren: Unternehmen sollten Sicherheitstests auf ein gestaffeltes System umstellen, das Routineprüfungen mit leichten Spezialmodellen abdeckt.
2. Agenten kontrolliert in DevSecOps testen: Project Perception soll ab August in die öffentliche Vorschau gehen. Ob autonome Teams zum Standard werden, ist noch offen.
3. Kosten im eigenen Ablauf messen: Microsoft nennt für den MDASH-Modellmix bis zu 90 Prozent Flash-Aufgaben und 50 Prozent Modellkosten im Vergleich. Lizenz-, Personal-, Prüf- und Infrastrukturkosten müssen Unternehmen separat berechnen.


