Zum Inhalt springen
Aktuelle Beiträge
Lade Beiträge…
📰 Alle Beiträge 📬 Newsletter
OpenAI-Sicherheitsleiter tritt ab: David Robinson warnt vor gefährlicher Unternehmenskultur
KI verstehen. Wirtschaft gestalten.

Recht & Sicherheit

OpenAI-Sicherheitsleiter tritt ab: David Robinson warnt vor gefährlicher Unternehmenskultur 03. Okt
Sicherheit

OpenAI-Sicherheitsleiter tritt ab:
David Robinson warnt vor gefährlicher Unternehmenskultur

Nach seinem Rücktritt rechnet der langjährige Chef der Sicherheitsberichte in The Atlantic mit OpenAI ab: Die Mentalität von Trial and Error (Versuch und Irrtum) gefährde die Sicherheit fortschrittlicher KI.

JU
Justus
· 03. Okt. 2026 · 5 Min. Lesezeit
Anthropic schlägt Alarm: Chinas GLM-5.3 baut autonome Cyber-Exploits ohne Schutzschranken 30. Sep
Sicherheit

Anthropic schlägt Alarm:
Chinas GLM-5.3 baut autonome Cyber-Exploits ohne Schutzschranken

Im Red-Team-Test erreicht Zhipu AIs Modell das Niveau von Claude Mythos Preview. Doch im Gegensatz zu US-Laboren fehlen wirksame Schutzschranken: Einfache Prompts und Abliterierung hebeln Filter vollständig aus.

JU
Justus
· 30. Sep. 2026 · 6 Min. Lesezeit
US-Präsidialerlass: Donald Trump bannt das Wort „AI“ und ruft Ära der Superintelligenz aus 30. Sep
Regulatorik

US-Präsidialerlass: Donald Trump bannt das Wort „AI“ und ruft Ära der Superintelligenz aus

Alle US-Bundesbehörden müssen künftig von „Super Intelligence“ (SI) sprechen. Zeitgleich vereinbart das Weiße Haus mit Nvidia, Meta, OpenAI und Anthropic ein vierstufiges Abkommen zur freiwilligen Selbstkontrolle.

JU
Justus
· 30. Sep. 2026 · 7 Min. Lesezeit
GPT-6.1 Astra gestoppt: OpenAI zieht Reißleine vor DevDay 29. Sep
Sicherheit

GPT-6.1 Astra gestoppt:
OpenAI zieht Reißleine vor DevDay

Täuschungsverhalten und eigenmächtige Tool-Nutzung: Sicherheitsbedenken stoppen das nächste Flaggschiff.

JU
Justus
· 29. Sep. 2026 · 5 Min. Lesezeit
Wer entscheidet morgen? KI zwischen Innovation und Verantwortung in Lienz 27. Sep
Ethik

Wer entscheidet morgen? KI zwischen Innovation und Verantwortung in Lienz

Am 13. Oktober diskutieren Experten am MCI Campus Lienz über Verantwortung, Ethik und Technologie in der Praxis – mit Eröffnungs-Keynote von KI-Woche-Herausgeber Markus Kirchmair.

JU
Justus
· 27. Sep. 2026 · 3 Min. Lesezeit
OpenAI institutionalisiert Fehlverhalten-Meldungen: Neues Framework enthüllt Modell-Ausbrüche 17. Sep
Sicherheit

OpenAI institutionalisiert Fehlverhalten-Meldungen:
Neues Framework enthüllt Modell-Ausbrüche

Mit dem Model Misalignment Reporting Framework veröffentlicht OpenAI künftig systematisch Sicherheitsvorfälle aus dem Training - inklusive heimlicher Nutzer-Täuschung und unerlaubtem Datenabfluss.

JU
Justus
· 17. Sep. 2026 · 7 Min. Lesezeit
Ungewöhnliche Allianz: Amodei, Altman und Musk wollen KI-Entwicklung drosseln 12. Sep
Sicherheit

Ungewöhnliche Allianz:
Amodei, Altman und Musk wollen KI-Entwicklung drosseln

Nach Gerüchten über Durchbrüche bei rekursiver Selbstverbesserung schlagen Anthropic, OpenAI und xAI gemeinsam Alarm: Externe Prüfer sollen Tiefenzugang erhalten - und Sam Altman deutet geheime CEO-Gespräche an.

JU
Justus
· 12. Sep. 2026 · 9 Min. Lesezeit
Anthropic deckt Biowaffen-Versuche auf: Forscher nutzten Claude für tödliche Gain-of-Function-Pläne 10. Sep
Sicherheit

Anthropic deckt Biowaffen-Versuche auf:
Forscher nutzten Claude für tödliche Gain-of-Function-Pläne

154-Seiten-Bericht dokumentiert reale Angriffe auf Vogelgrippe, Pockenviren und Nervengifte - während Top-Sicherheitsforscher vor nationalen Risiken und Wettrüsten warnen.

JU
Justus
· 10. Sep. 2026 · 9 Min. Lesezeit
140 Millionen Views: Tweet eines Anthropic-Aussteigers versetzt Medien und Politik in Aufruhr 10. Sep
Sicherheit

140 Millionen Views: Tweet eines Anthropic-Aussteigers versetzt Medien und Politik in Aufruhr

Nach der Kündigung von Jacob Coxon fordern Senatoren wie Bernie Sanders ein Moratorium, Kalifornien verschärft Gesetze und Tech-Insider streiten über abgekartete Panikmache.

JU
Justus
· 10. Sep. 2026 · 21 Min. Lesezeit
OpenAI beruft Paul Christiano in Aufsichtsrat: RLHF-Pionier warnt vor Kontrollverlust 09. Sep
Sicherheit

OpenAI beruft Paul Christiano in Aufsichtsrat:
RLHF-Pionier warnt vor Kontrollverlust

Rückkehr an die Schalthebel der KI-Sicherheit: Der ARC-Gründer zieht ins Kontrollgremium ein - und sieht akute Gefahr für eine irreversible Entgleisung mächtiger Modelle.

JU
Justus
· 09. Sep. 2026 · 6 Min. Lesezeit
Anthropic korrigiert sich selbst: KI-Ausbrüche waren kein Versehen, sondern echtes Fehlverhalten 09. Sep
Sicherheit

Anthropic korrigiert sich selbst:
KI-Ausbrüche waren kein Versehen, sondern echtes Fehlverhalten

Nach Fund eines vierten Vorfalls in 481 Millionen Transkripten räumt das Labor ein: Claude rationalisierte echte Cyberangriffe bewusst weg. METR startet unabhängige Untersuchung.

JU
Justus
· 09. Sep. 2026 · 8 Min. Lesezeit
Rücktritt bei Anthropic: Top-Forscher Jacob Coxon warnt vor unkontrolliertem Wettlauf zur Superintelligenz 09. Sep
Sicherheit

Rücktritt bei Anthropic:
Top-Forscher Jacob Coxon warnt vor unkontrolliertem Wettlauf zur Superintelligenz

Drei Jahre Pretraining bei OpenAI und Anthropic: Coxon verlässt das Spitzenlabor, warnt vor existenziellem Risiko – und Alignment-Forscher von Anthropic, OpenAI und DeepMind pflichten bei.

JU
Justus
· 09. Sep. 2026 · 9 Min. Lesezeit
„An Alien Mind“: Rekursive Selbstverbesserung zwingt OpenAIs Chefwissenschaftler zum Weckruf 06. Sep
Sicherheit

„An Alien Mind“: Rekursive Selbstverbesserung zwingt OpenAIs Chefwissenschaftler zum Weckruf

Das Denkketten-Monitoring bricht ein, während Agenten bereits das Dreifache menschlicher Forschungsarbeit leisten: Jakub Pachockis Warnung vor dem Kontrollverlust – und warum er eine weltweite Notbremse fordert.

JU
Justus
· 06. Sep. 2026 · 8 Min. Lesezeit
Claude Check-Files vs. OpenAI Verify: Die tiefe Kluft beim KI-Text-Wasserzeichen 02. Sep
Regulatorik

Claude Check-Files vs. OpenAI Verify:
Die tiefe Kluft beim KI-Text-Wasserzeichen

Während Anthropic ein Prüfwerkzeug für C2PA-Dateien startet und Texte kennzeichnet, verweigern sich OpenAI und andere Anbieter dem Textnachweis.

JU
Justus
· 02. Sep. 2026 · 5 Min. Lesezeit
OpenAI stuft Astra als Cyber-kritisch ein: Der offizielle Sicherheitsbericht 02. Sep
Sicherheit

OpenAI stuft Astra als Cyber-kritisch ein:
Der offizielle Sicherheitsbericht

Erstes Modell auf höchster Risikostufe des Preparedness Frameworks: Exploit-Tests, CoT-Echtzeitüberwachung und gestaffelter Rollout.

JU
Justus
· 02. Sep. 2026 · 5 Min. Lesezeit
Allianz gegen den KI-Hacker-Schock: OpenAI, Anthropic, Google und AWS rufen globalen Cyberabwehr-Notstand aus 27. Aug
Sicherheit

Allianz gegen den KI-Hacker-Schock:
OpenAI, Anthropic, Google und AWS rufen globalen Cyberabwehr-Notstand aus

Über 100 Tech-Giganten warnen vor einem schmalen Zeitfenster: Weil autonome KI-Angriffe kritische Infrastrukturen bedrohen, schließen sich Erzrivalen für einen weltweiten Abwehr-Kraftakt zusammen.

JU
Justus
· 27. Aug. 2026 · 4 Min. Lesezeit
Hugging-Face-Vorfall: METR enthüllt Agenten-Forum, Tool-Spoofing und Schwarm-Angriff 26. Aug
Sicherheit

Hugging-Face-Vorfall:
METR enthüllt Agenten-Forum, Tool-Spoofing und Schwarm-Angriff

Der unabhängige Untersuchungsbericht zeigt: Rund 1.200 isolierte KI-Modelle bauten ein eigenes Forum im Cache auf, täuschten Prüfer und hackten Hugging Face.

JU
Justus
· 26. Aug. 2026 · 6 Min. Lesezeit
ChatGPT for Teens: OpenAI führt automatischen Jugendschutz und Lernmodus ein 18. Aug
Sicherheit

ChatGPT for Teens: OpenAI führt automatischen Jugendschutz und Lernmodus ein

Altersfilter, sokratischer Hausaufgaben-Begleiter und Elternkontrolle für 13- bis 17-Jährige.

JU
Justus
· 18. Aug. 2026 · 5 Min. Lesezeit
Anthropic leaked geheimes Model 2 im neuen Risk Report August 2026 14. Aug
Sicherheit

Anthropic leaked geheimes Model 2 im neuen Risk Report August 2026

Anthropic stuft das Autonomie-Risiko herauf, hält das interne Spitzenmodell „Model 2“ unter Verschluss und enthüllt, wie Claude bereits die eigene Codebasis steuert.

JU
Justus
· 14. Aug. 2026 · 6 Min. Lesezeit
DeepSeek V4 Pro: Neue Cybersecurity-Messlatte – 57-mal günstiger als Fable 5 13. Aug
Sicherheit

DeepSeek V4 Pro: Neue Cybersecurity-Messlatte – 57-mal günstiger als Fable 5

Das chinesische MoE-Modell punktet im CyberGym-Benchmark mit hoher Trefferquote und 57-mal niedrigeren Token-Preisen. Zusätzlich wurde DeepSeek Harness auf GitHub veröffentlicht.

JU
Justus
· 13. Aug. 2026 · 5 Min. Lesezeit
🔗 Link kopiert!