Technologie & Forschung

Das Modell-Feuerwerk geht weiter:
Warten auf Apple Intelligence, GPT-5.6, Gemini 3.5 Pro, Mythos 5 und Sonnet 4.8
Eine außergewöhnliche Woche in der KI-Entwicklung. Fünf neue Modelle von OpenAI, Google, Anthropic und Apple - einige bestätigt, andere Spekulation. Und WWDC startet morgen.

KI-Drohne schlägt drei Drohnen-Weltmeister:
Wie TU Delft die Grenzen physischer KI neu gezogen hat
Eine Kamera, kein GPS, keine Karte - und trotzdem schneller als die besten menschlichen FPV-Piloten der Welt. Was das MAVLab-Team technisch gemacht hat.

Claude Mythos kommt: Codename Oceanus im Red-Teaming - Launch um den 11. Juni
Erste Outputs begeistern die Community. Oceanus schreibt in 5 Minuten eine eigene 3D-Engine. Red-Teaming läuft, der Release-Termin naht.

LM Studio bringt lokale KI-Modelle aufs iPhone
Locally heißt die neue iOS-App von LM Studio. Sie verbindet sich per LM Link mit dem Desktop und macht große lokale Modelle mobil nutzbar.

Hermes Desktop: Nous Research bringt Open-Source-Agenten auf Mac, Windows und Linux
Mit Hermes Desktop wird der offene KI-Agent zur nativen App. Die Software integriert sich tief in das Betriebssystem und bietet persistentes Gedächtnis sowie isolierte Sandbox-Umgebungen.

Project Solara: Microsoft baut Agent-First-Hardware auf Android-Basis
Auf der Build 2026 zeigt Microsoft zwei Referenzgeräte - Desktop Hub und Wearable Badge - die keine Apps mehr ausführen, sondern ausschließlich KI-Agenten. Die Plattform läuft auf Android, nicht Windows.

Sieben neue MAI-Modelle:
Microsoft setzt auf Hillclimbing-Architektur
Microsoft AI launcht sieben spezialisierte Modelle - von Reasoning über Coding bis Multimodal. Die Hillclimbing-Strategie ersetzt den Alles-in-einem-Ansatz.

Project Eden: Tripos Weltmodell entkoppelt Zustand und Darstellung
VAST AI Research veröffentlicht eine Research Preview: Ein persistentes Weltmodell, das den Spielzustand vom Rendering trennt - und damit echtes Multiplayer sowie KI-Agententraining in generierten Welten ermöglicht.

Nemotron 3 Ultra: Nvidia liefert das stärkste offene KI-Modell der USA
550 Milliarden Parameter, 55 Milliarden aktiv, 309 Tokens pro Sekunde: Mit Nemotron Ultra greift Nvidia die proprietären Frontier-Modelle an - und veröffentlicht alles als Open Source.

Nvidias Referenz-Humanoider:
Ein Roboter als Blaupause für die ganze Industrie
Nvidia stellt mit dem Isaac GR00T Reference Robot den ersten offenen humanoiden Referenzentwurf vor. Der Ansatz erinnert an Googles Nexus-Strategie: Chip, Software und Blaupause liefern - die Fertigung anderen überlassen.

MiniMax M3: Chinas erstes Open-Weight-Modell auf Frontier-Niveau
MiniMax veröffentlicht M3 mit einer neuen Sparse-Attention-Architektur, die eine Million Token Kontext bei einem Zwanzigstel der bisherigen Rechenkosten ermöglicht. In Benchmarks liegt es auf Augenhöhe mit GPT-5.5 und Claude Opus 4.7.

RTX Spark: Nvidias Antwort auf Apple Silicon - und eine Kampfansage an Intel, AMD und Qualcomm
Nvidia vereint erstmals CPU und GPU in einem ARM-Superchip für Windows-PCs. Mit 1 Petaflop KI-Leistung, vollem CUDA-Ökosystem und AAA-Gaming löst RTX Spark das Problem, an dem bisherige Windows on ARM Versuche gescheitert sind.

ForecastBench: Können KI-Modelle die Zukunft vorhersagen?
Ein neuer Benchmark testet KI-Prognosen gegen menschliche Superforecaster. Die Modelle holen auf - aber die besten Prognostiker liegen noch vorn.

OpenAI Rosalind Biodefense:
Ein KI-Modell für die Pandemieabwehr - und ein strategischer Schachzug
OpenAI gibt Regierungen und Forschungslaboren Zugang zu GPT-Rosalind, einem Frontier-Modell für Biosicherheit. Die Strategie dahinter ist mindestens so interessant wie die Technologie.

Computer nur mit Stimme steuern:
Was GPT-Realtime 2.0 als Betriebssystem-Schnittstelle kann
Ein Entwickler zeigt, wie OpenAIs Echtzeit-Sprachmodell den Computer ohne Tastatur und Maus bedient - und warum das mehr ist als eine Demo.

PiD: NVIDIAs Pixel-Decoder macht KI-Bilder in unter einer Sekunde 4K-scharf
Der neue Decoder vereint Dekodierung und Upscaling in einem Schritt - sechsmal schneller als bisherige Verfahren, Open Source, und läuft auf einer Consumer-Grafikkarte.

Codex Thursday ohne Codex:
OpenAIs geheimnisvoller Nicht-Launch
Statt des erwarteten großen Releases gab es nur ein CLI-Update. Was OpenAI am Mittwoch zurückgehalten hat, bleibt unklar.

Opus 4.8 in der Praxis:
Shader, Spiele und eine Boeing 747 ohne menschliches Zutun
Entwickler testen Anthropics neues Topmodell und staunen: autonomes Debugging, sieben Feedback-Loops, spielbare Browser-Games in einem Prompt. Nicht alles ist perfekt.

Startup in New York City startet kostenlosen Putzdienst, bezahlt wird mit Trainingsdaten
Das Startup MicroAGI bietet kostenlosen Reinigungsservice - im Tausch gegen Ego-Perspektiv-Videos, die Haushaltsroboter trainieren sollen. Zwei Millionen Views in Stunden.

Gemini 3.5 Flash schreibt ein Betriebssystem und bootet Doom
93 Subagenten, 15.314 Model Calls, 12 Stunden: Googles Antigravity-Team lässt einen Schwarm KI-Agenten Kernel, Dateisystem und Treiber von Grund auf programmieren.