Kai

SpaceXAI legt nach Grok Bot mit Grok 4.6 nach:
Neues Modell auf Frontier-Niveau
Nur einen Tag nach dem Agenten-Betriebssystem folgt xAIs neues Flaggschiff: Grok 4.6 bringt Selbstverifizierung bei langen Aufgaben, schneidet beim Artificial Analysis Index auf Augenhöhe mit GPT-5.6 Sol ab und Elon Musk kündigt bereits Grok 4.7 für September an.

Platz 2 auf der Arena:
Microsoft attackiert Google und Meta mit MAI-Image 2.6
Zusammen mit dem 75 Prozent günstigeren MAI-Code 1.1 Flash zieht Mustafa Suleyman das Tempo bei Microsofts hauseigenen KI-Modellen an.

Grok Bot: SpaceXAI bringt KI-Kollegen mit eigenem Cloud-PC
Von Chatbots zu autonomen Arbeitsgruppen: Wie xAIs neue Bot-Flotte 24/7 im Hintergrund Aufgaben erledigt.

NVIDIA Nemotron 3.5 Lightning 30B:
3B aktive Parameter für lokale KI-Agenten
Das neue offene MoE-Mamba-Modell setzt auf NVFP4-Quantisierung und 1 Million Token Kontext für Desktop- und Edge-Systeme.

Meta Muse Glimmer: Erster lokaler KI-Agent mit Claude-Cowork-Usability
Das 30B-Modell erreicht laut Benchmarks Gemini 3.5 Flash-Niveau und läuft dank Unsloth und LM Studio lokal auf Mac und PC.

25 Jahre altes MIMO-Rätsel gelöst:
KI knackt ungelöstes Mobilfunk-Problem
GPT-5.6 und Claude Fable beweisen, dass die mathematische Höchstgrenze der MIMO-Signalrekonstruktion in polynomeller Zeit erreichbar ist – ohne Rechenzeit-Kluft.

Mona-Lisa-1: OpenAIs geheimnisvolles Bildmodell in der Arena gesichtet
Ein unangekündigtes Modell sorgt in den Arena-Matches für Furore. Erste Tests zeigen SynthID-Wasserzeichen und deutliche Sprünge bei Typografie und Fotorealismus.

Bio-Risiken werden real:
Forscher erschaffen 16 neuartige Viren mit KI
Forscher von Stanford und dem Arc Institute lassen mit dem Genom-Modell Evo 16 künstliche Bakteriophagen entstehen — ein Meilenstein für die Medizin und eine Debatte für die Biosecurity.

Donut-Design und Jony Ive:
OpenAIs erster KI-Lautsprecher enthüllt
Das bildschirmlose Hardware-Debüt soll 2027 für über 300 Dollar erscheinen — mit Kameras, Mechanik und eigener Persönlichkeit.

Alibaba stellt Video-Modell Wan 3 vor:
Konkurrenz für Seedance 2.5 und FLUX 3
Mit Wan 3 bringt Alibaba ein multimodales KI-Videomodell mit synchronem Audio, Omni-Modal Reference und 30-Sekunden-Generierung auf Qwen Cloud.

Luna für alle: OpenAI macht GPT-5.6 kostenlos unlimitiert - und bringt den Denk-Slider
Das schlanke Modell Luna wird Standard für alle Gratis-Nutzer. Dazu gibt es unbegrenzten Text-Chat, einen Denk-Knopf und stufenlose Reasoning-Regler für Zahlkunden.

Meta bläst zur KI-Aufholjagd:
Muse-Code und Muse-Spark 1.2 vorgestellt
Meta AI Research bringt neuen Terminal-Coding-Agenten mit persistenten Subagenten und absturzsicherem Event-Log.

Prime Agent: Prime Intellect bringt Open-Source Agent Framework
Neuer RLM-Agent kombiniert rekursiven Python-Kernel mit Continual Harness und schlägt die ARC-AGI-3-Mensch-Baseline.

Liquid AI LFM 2.5: Der 2,6-Milliarden-Agent für das Smartphone
Neues On-Device-Modell kombiniert Hybrid-Architektur mit vierstufigem Post-Training für lokale Automatisierung.

Mathematik in der WTF-Phase:
Wie KI das Forschungstempo explodieren lässt
Zehn neue Ergebnisse zu langjährigen offenen Problemen, rund 2.000 Dollar Tokenkosten und nur Monate zwischen den Fähigkeitssprüngen - Astra zeigt, wie rasant KI wissenschaftliche Arbeit verändert.

Google-Studie: Safety-Tuning verzerrt Menschenbild und Empathie von KI-Modellen
Das Unterdrücken von Bewusstseins-Aussagen lässt KI-Modelle auch Tiere und menschliche Werte entwerten.

StarMind & TeraFab:
SpaceX präsentiert nach IPO 7,8 Milliarden Umsatz und Orbital-KI
Mit 100 Milliarden Dollar Cash und NVIDIA-Rubin-Chips will SpaceX das größte KI-Rechennetzwerk im All bauen.

FLUX 3 Video startet offiziell:
Black Forest Labs schaltet neues KI-Videomodell frei
Nach der geschlossenen Testphase ist das KI-Videomodell über die BFL-API und Partner wie Higgsfield verfügbar – inklusive Nativ-Audio und Draft-Modus.

Alibaba spielt mit Qwen 3.8 Max in der ersten KI-Liga mit - und liefert auch eine schlanke Version für den Heimrechner
Alibaba veröffentlicht das Flaggschiff Qwen 3.8-Max — und stellt mit Qwen 3.8-27B auch eine kompakte Open-Weight-Variante für Consumer-Hardware bereit - sie läuft sogar auf Notebooks mit 24 GB RAM.

1 Million Tokens für ein Buchkapitel:
Karpathys 3D-Experiment zeigt das Ende klassischer LLM-Benchmarks
Mit Claude Opus 5 und 10 Dollar Token-Budget lässt Andrej Karpathy komplette 3D-Welten per Three.js erschaffen — und deckt eine große Schwäche autonomer Agenten auf.