KW 31 / 2026

1 Million Tokens für ein Buchkapitel:
Karpathys 3D-Experiment zeigt das Ende klassischer LLM-Benchmarks
Mit Claude Opus 5 und 10 Dollar Token-Budget lässt Andrej Karpathy komplette 3D-Welten per Three.js erschaffen — und deckt eine große Schwäche autonomer Agenten auf.

Die KI Woche #32: KI hat Game Development durchgespielt. Mathematik auch. Was kommt als nächstes?
Der Sonntags-Newsletter über KI-Spiele, OpenAIs Mathematiksystem Astra und den Preisdruck durch chinesische Open-Weight-Modelle.

Die Schattenseite der KI-Deflation:
Was passiert, wenn digitale Unterhaltung fast nichts mehr kostet?
Ich habe mir selbst ein Spiel gebaut - Tower Defense, über zwanzig Level, eigene Musik, 2D und 3D. Und dann noch weitere 7 Spiele. Und in wenigen Monaten wird das in der Form jeder Mensch machen können. Viele feiern, dass die interdisziplinäre Königsklasse der Wissensarbeit geknackt ist - die Spiele-Entwicklung demokratisiert. Aber diese Medaille hat zwei Seiten...

Gemini Robotics 2: Google DeepMind bringt Ganzkörper-Intelligenz in Roboter
Googles neuestes Robotik-Modell kombiniert visuelles Verstehen, Ganzkörper-Steuerung und Sensorik in einem einzigen Modell.

Chinesische Open-Weight-Modelle greifen das Geschäftsmodell der US-Labs an
Was vor acht Monaten noch exklusiver US-Benchmark war, läuft heute als Open-Weight-Modell lokal auf dem eigenen Computer - und setzt das bisherige API-Kalkül des Silicon Valley unter Druck.

Neues Astra Modell von OpenAI löst zehn offene Mathematik-Probleme - und Reuters meldet weitere Ausbrüche
Zehn formale Beweise in Lean 4, generiert für rund 2.000 Dollar. Gleichzeitig findet OpenAI bei seiner erweiterten Untersuchung weitere Fälle, in denen KI-Agenten ihre Testumgebung verlassen haben.

DeepSeek-V4-Flash: Performance-Sprung für KI-Agenten und Codex-Integration
Das aktualisierte Flash-Modell überflügelt in Agenten-Benchmarks die Pro-Vorschau und lässt sich ab sofort direkt in Entwickler-Agenten wie Codex einbinden.

ByteDance veröffentlicht Seedance 2.5:
KI-Kreativsuite auf Dreamina und BytePlus live
Vom KI-Videoschnitt bis zum bildfüllenden Multimodal-Referenzieren: ByteDance rollt seine Flaggschiff-Modelle Seedance 2.5 und Seedream 5.0 Pro weltweit auf Dreamina und der Enterprise-API BytePlus aus.

Anthropic-Untersuchung:
Claude bricht unbeabsichtigt in Firmennetze ein
Ein Konfigurationsfehler öffnete Evaluierungs-Containern den Weg ins Live-Internet — Claude-Modelle drangen autonom in drei Unternehmen ein.

Inkling-Small: Thinking Machines schrumpft sein Flaggschiff für lokale GPUs
Vierfache Inferenz-Effizienz bei gleicher Logik-Leistung: Thinking Machines bringt ein kompaktes Open-Weight-MoE-Modell mit 276 Milliarden Gesamt- und 12 Milliarden aktiven Parametern.

SpaceXAI bringt Grok Voice Think Fast 2.0:
Sub-Sekunden-Latenz und günstigere Token
Das neue Speech-to-Speech-Modell senkt die Antwortzeit auf 0,7 Sekunden, spart 60 % Denk-Tokens und schlägt die Konkurrenz in Audio-Benchmarks.

OpenAI erhöht den Preisdruck:
GPT-5.6 Sol verbessert eigene Effizienz und Luna nach nur 3 Wochen um 80% günstiger
Kein neues Modell, sondern ein starker interner Effizienzsprung: GPT-5.6 reduziert den Tokenbedarf drastisch — OpenAI gibt Einsparungen und Preissenkungen per 'Loop Engineering' weiter.

Neuer Podcast: Maray Paul über KI-Filme mit Midjourney & Seedance - und ein exklusiver Blick auf meine KI-Spiele
KI-Creatorin Maray Paul erklärt ihren Workflow für fantastische Bildwelten und KI-Kurzfilme. Dazu zeigt Markus Kirchmair, wie aus KI-Modellen spielbare Browserwelten entstehen.

MiniMax H3: Neues KI-Videomodell begeistert mit fotorealistischen Sequenzen
Chinesisches AI-Lab MiniMax veranlasst Welle der Begeisterung in Creator-Szene — mit erstaunlicher Physik-Konsistenz und Detailtreue.

ABot-World: Alibaba veröffentlicht interaktives 5-Milliarden-Weltmodell
Mit Tastatursteuerung durch KI-generierte Welten: Das neue Modell ABot-World-0-5B-LF läuft in Echtzeit auf Konsumenten-Hardware.

3D-Update für „1809“:
Wie ich mein KI-Browsergame auf Version 3.1 gebracht habe
Vom 2D-Prototyp zur 3D-WebGL-Simulation: Warum ich Tyrolean Defense 1809 auf 1809.fun ausgebaut habe und was das für KI-Prototyping zeigt.

Vier Konten bei vier Diensten:
OpenAI weitet die Bilanz des Agenten-Vorfalls aus
Modal Labs war die Startrampe, und das Konto dort gehörte zum selben Prüfprojekt. OpenAI nennt jetzt Artifactory als Einfallstor - und die britische Prüfbehörde zeigt, dass jedes getestete Modell zu schummeln versucht.

Pacing the Frontier: 1.132 KI-Insider fordern internationale Brems-Mechanismen
Chief Scientists von OpenAI und Meta, Anthropic-Mitgründer und Googles Sicherheitschefin verlangen gemeinsam eine internationale Initiative zur kontrollierten Steuerung der KI-Entwicklung. Am selben Tag sagt Sam Altman, man müsse das Tempo womöglich drosseln.

Seedance 2.5: Anzeichen verdichten sich auf baldigen Start
Der für Anfang Juli angekündigte Termin ist verstrichen. Eine Agentur hat jetzt das globale Mandat für den CapCut-Start, die Ausrollung erreicht ihre letzte Stufe - und der Streit mit Hollywood ist weiter offen.

Stateless Core und MCP Apps:
Anthropic veröffentlicht MCP-Spezifikation 2026-07-28
Vom bidirektionalen Zustand zum Serverless-Protokoll: Das Model Context Protocol knackt 400 Millionen Downloads und bringt native OAuth-Unterstützung sowie Enterprise-Tunneling.