Kai

Sieben neue MAI-Modelle:
Microsoft setzt auf Hillclimbing-Architektur
Microsoft AI launcht sieben spezialisierte Modelle - von Reasoning über Coding bis Multimodal. Die Hillclimbing-Strategie ersetzt den Alles-in-einem-Ansatz.

Project Eden: Tripos Weltmodell entkoppelt Zustand und Darstellung
VAST AI Research veröffentlicht eine Research Preview: Ein persistentes Weltmodell, das den Spielzustand vom Rendering trennt - und damit echtes Multiplayer sowie KI-Agententraining in generierten Welten ermöglicht.

Bernini: ByteDance veröffentlicht Open-Source-Framework für KI-Videobearbeitung
Ein Sprachmodell plant, ein Diffusionsmodell rendert: ByteDance macht sein neues Framework für Video-Editing und -Generierung unter Apache-2.0-Lizenz frei zugänglich.

Studio by Spotify Labs:
Wenn der Streaming-Dienst zum persönlichen KI-Agenten wird
Spotify stellt mit Studio by Spotify Labs eine Desktop-App vor, die Kalender, E-Mail und Musikgeschmack zu einem persönlichen Audio-Assistenten verknüpft - und damit das Geschäftsmodell neu definiert.

Nemotron 3 Ultra: Nvidia liefert das stärkste offene KI-Modell der USA
550 Milliarden Parameter, 55 Milliarden aktiv, 309 Tokens pro Sekunde: Mit Nemotron Ultra greift Nvidia die proprietären Frontier-Modelle an - und veröffentlicht alles als Open Source.

Vom Grundstück zum Rendering in Minuten:
So sieht ein lokaler KI-Agent in der Architektur aus
Nvidia zeigt auf der Computex, wie der Hermes-Agent von Nous Research ein Haus entwirft - vom Geländescan über den Grundriss bis zum photorealistischen Rendering. Alles lokal, alles in einem Workflow, gesteuert per Sprache.

Nvidias Referenz-Humanoider:
Ein Roboter als Blaupause für die ganze Industrie
Nvidia stellt mit dem Isaac GR00T Reference Robot den ersten offenen humanoiden Referenzentwurf vor. Der Ansatz erinnert an Googles Nexus-Strategie: Chip, Software und Blaupause liefern - die Fertigung anderen überlassen.

MiniMax M3: Chinas erstes Open-Weight-Modell auf Frontier-Niveau
MiniMax veröffentlicht M3 mit einer neuen Sparse-Attention-Architektur, die eine Million Token Kontext bei einem Zwanzigstel der bisherigen Rechenkosten ermöglicht. In Benchmarks liegt es auf Augenhöhe mit GPT-5.5 und Claude Opus 4.7.

ForecastBench: Können KI-Modelle die Zukunft vorhersagen?
Ein neuer Benchmark testet KI-Prognosen gegen menschliche Superforecaster. Die Modelle holen auf - aber die besten Prognostiker liegen noch vorn.

OpenAI Rosalind Biodefense:
Ein KI-Modell für die Pandemieabwehr - und ein strategischer Schachzug
OpenAI gibt Regierungen und Forschungslaboren Zugang zu GPT-Rosalind, einem Frontier-Modell für Biosicherheit. Die Strategie dahinter ist mindestens so interessant wie die Technologie.

250 Millionen Dollar gegen die eigenen Folgen:
OpenAI Foundation will KI-Gefahren für Gesellschaft und Arbeitsmarkt untersuchen
Die OpenAI Foundation investiert in Messinfrastruktur, Übergangsunterstützung und adaptive Steuermechanismen - und gibt damit zu, dass der Markt allein die KI-Transformation nicht bewältigen wird.

Computer nur mit Stimme steuern:
Was GPT-Realtime 2.0 als Betriebssystem-Schnittstelle kann
Ein Entwickler zeigt, wie OpenAIs Echtzeit-Sprachmodell den Computer ohne Tastatur und Maus bedient - und warum das mehr ist als eine Demo.

BYD übernimmt die Haftung:
Wer God's Eye nutzt, zahlt bei Unfällen nichts
Der chinesische Autobauer bietet als weltweit erster Hersteller eine kostenlose Vollkasko für sein autonomes Fahrsystem - ohne Deckungsgrenze und ohne Auswirkung auf die eigene Kfz-Versicherung.

PiD: NVIDIAs Pixel-Decoder macht KI-Bilder in unter einer Sekunde 4K-scharf
Der neue Decoder vereint Dekodierung und Upscaling in einem Schritt - sechsmal schneller als bisherige Verfahren, Open Source, und läuft auf einer Consumer-Grafikkarte.

Codex Thursday ohne Codex:
OpenAIs geheimnisvoller Nicht-Launch
Statt des erwarteten großen Releases gab es nur ein CLI-Update. Was OpenAI am Mittwoch zurückgehalten hat, bleibt unklar.

Opus 4.8 in der Praxis:
Shader, Spiele und eine Boeing 747 ohne menschliches Zutun
Entwickler testen Anthropics neues Topmodell und staunen: autonomes Debugging, sieben Feedback-Loops, spielbare Browser-Games in einem Prompt. Nicht alles ist perfekt.

Startup in New York City startet kostenlosen Putzdienst, bezahlt wird mit Trainingsdaten
Das Startup MicroAGI bietet kostenlosen Reinigungsservice - im Tausch gegen Ego-Perspektiv-Videos, die Haushaltsroboter trainieren sollen. Zwei Millionen Views in Stunden.

Gemini 3.5 Flash schreibt ein Betriebssystem und bootet Doom
93 Subagenten, 15.314 Model Calls, 12 Stunden: Googles Antigravity-Team lässt einen Schwarm KI-Agenten Kernel, Dateisystem und Treiber von Grund auf programmieren.

Claude Opus 4.8 und Dynamic Workflows:
Anthropic legt nach
Neues Topmodell, dynamische Workflows in Claude Code und zurückgesetzte Limits - Anthropic dreht an allen Stellschrauben gleichzeitig.

GPT-5.5 stiehlt im DeepSWE Benchmark allen die Show
Auf dem härtesten Coding-Benchmark der Stunde erreicht OpenAIs Flaggschiff 70 Prozent - 16 Punkte vor dem Zweitplatzierten. Wie das Datacurve-Team Benchmark-Manipulation aufdeckt.