Kai

Aus Aeon wird „o“:
OpenAIs persönlicher Dauer-Agent steht vor dem DevDay-Start
Offizielle Keynote-Ankündigung und visuelle Parallelen zu Grok Bot: Warum OpenAIs Always-on-Assistent am Dienstag zur dauerhaften Schaltzentrale wird.

Waymo-Sicherheitsdaten:
270 Millionen Meilen und 95 Prozent weniger schwere Unfälle als menschliche Autofahrer
20-mal sicherer als menschliche Fahrer: Warum Jeff Dean das Robotaxi als fortgeschrittenste Embodied-AI-Anwendung bezeichnet.

Gemini 4 Pro: Neue Leaks deuten auf starkes Comeback von Google hin
Animierte Three.js-Welten, halbierte Generierungszeiten und ein frischer Arena-Checkpoint: Warum Googles nächstes Flaggschiff für Aufsehen sorgt.

FLUX 3 Action: Black Forest Labs veröffentlicht 7B-Weltmodell für Robotik
Offene Gewichte, LeRobot-Anbindung und Benchmark-Sieg: Warum das Freiburger Start-up Nvidia Cosmos 3 bei halber Modellgröße schlägt.

Meta Connect 2026: 100-Gramm-VR-Brille, Ray-Ban Gen 3 und Audio-Glasses vorgestellt
5K Micro-OLED im Brillenformat, kamerafreie Audio-Frames und Muse-Agenten: Meta rüstet das Wearable-Ökosystem radikal auf.

Epoch AI Studie: Die Kosten für KI-Denken fallen um 47 Prozent pro Quartal
13-mal günstiger pro Jahr: Warum der Preisverfall bei KI-Inferenz jede frühere Basistechnologie wie Strom oder Mikrochips in den Schatten stellt.

Biologie-Durchbruch: Claude entdeckt neuartiges Enzymsystem mit CRISPR-ähnlichen Repeats
Eigenes Labor und 950 KI-Agenten: Anthropic isoliert in Bakteriophagen eine bisher unbekannte Klasse molekularer Werkzeuge (ART).

Von wegen stochastischer Papagei:
Sprachmodelle Astra, Sol, Grok und Fable steuern im DrivingBench echten Toyota
Vom angeblichen stochastischen Papagei zum Chauffeur: Wie Frontier-Modelle via MCP und Openpilot eine echte PKW-Limousine lenken.

Enorme Preis-Reduktion:
OpenAI lanciert GPT-6 Sol und Luna
Halbierte Token-Preise und 1 Million Kontext: OpenAI greift mit zwei spezialisierten GPT-6-Varianten den Markt an.

Claude Opus 5.5: Flaggschiff-Leistung auf Fable-Niveau bei 40 Prozent weniger Kosten
Anthropic eröffnet die neue 5.5-Generation: Platz eins im Artificial Analysis Index, Spitzenwerte bei Terminal-Bench und drastisch verbilligte Cache-Reads fordern OpenAI und das eigene Modell Fable 5.1 heraus.

Meta Muse erobert die App-Charts:
192 Milliarden Dollar Börsenplus und offener Agentenkrieg mit Amazon
Metas neuer KI-Agent verdrängt ChatGPT von Platz eins und löst den ersten großen Plattformkampf aus: Während Amazon Muse per Nutzungsbedingungen aussperrt, binden Shopify-Händler ihre Kataloge nativ an.

Gerüchteverdichtung im Modell-Feuerwerk:
OpenAI plant neuen Dauer-Agent „Aeon“, GPT-6 Luna und Sol stehen bereit – Anthropic kontert mit Opus 5.5
OpenAI bereitet mit Aeon eine Antwort auf Grok Bot vor, rollt GPT-6 Sol und Luna in den Grayscale-Test und streicht Terra. Zeitgleich steht Anthropics Claude Opus 5.5 bereit.

Xiaomi MiMo-V2.6: Open-Weights-Flaggschiff mit 1-Billion-MoE schlägt Kimi und Qwen
Mit 46,32 Punkten führt MiMo-V2.6-Pro den Artificial Analysis Intelligence Index für Open-Source-Modelle an. 30 öffentlich gestreamte RL-Schritte und erste Community-Demos: Selbst MiMo-V2.6 Flash generiert lauffähige 3D-Spiele wie „3D Sonic“.

OpenAI gründet unabhängigen Mathematik-Beirat nach Kontroverse um Navier-Stokes
Neun Spitzenmathematiker am Institute for Advanced Study sollen den Umgang mit KI-Beweisen ordnen - das interne Entwicklungstempo bleibt unberührt.

Grok 4.7: SpaceXAI rüstet Coding- und Wissensarbeit bei gleichem Preis auf
Größeres Basismodell zielt auf Fable 5.1 und GPT-5.6 Sol, doch in der Entwickler-Community überwiegt Ernüchterung: Massive Token-Verbrennung und Schwächen bei 3D und Frontend dämpfen die Euphorie.

Step-5 Preview: StepFun lanciert 600B-MoE-Flaggschiff für Langzeit-Agenten
Chinesisches KI-Startup attackiert die Pareto-Grenze und kündigt offene Modellgewichte für Oktober an.

Claude Opus 5.5, GPT-6 Sol und Kimi K3.1:
Super-Woche im Modellrennen erwartet
Anthropic soll Zwischenschritte überspringen und direkt Opus 5.5 bringen. Gleichzeitig deuten Leaks auf GPT-6 Sol und Kimi K3.1 hin, während Gemini 4 in den Oktober rutscht.

Jev im Praxistest: Entwickler-Echo, Vercel-Rekord und Demos zum System-One-Modell
Vercel meldet die schnellste Adaption der Gateway-Geschichte, Aaron Levie testet Enterprise-Triage bei Box und Entwickler lassen Jev gegen Haiku antreten.

Bonsai 2 27B: Prism ML bringt ternäres Modell mit 98,2 Prozent Retention
Das Caltech-Spin-off komprimiert Qwen 3.8 von 55,6 auf 5,9 Gigabyte. Erste Härtetests der Community zeigen jedoch Schwächen bei autonomen Coding-Agenten.

Claude Fable 5.2 und Opus 5.2 vor Comeback:
Anthropics Doppel-Angriff auf GPT-6 Astra
Verdeckte Shadow-Tests in Claude Code enthüllen zwei neue Flaggschiffe: Fable 5.2 generiert spielbare 3D-Klone und schlägt Astra, während Opus 5.2 komplexe Städte und animierte Filme im Browser rendert.