Kai

Claude Fable 5.1 kurz vor dem Start? Wettquoten und Leaks heizen Gerüchte um neues Anthropic Flaggschiff an
Auf Polymarket wetten Trader zwischenzeitlich zu über 50 Prozent auf einen Launch bis Ende August - während Sicherheitsfortschritte und Community-Hinweise auf ein baldiges Mythos-Update deuten.

Apple stellt M6 und M5 Ultra vor:
2-Nanometer-Sprung und Quad-Die für lokale Riesen-Modelle
Mac mini und Mac Studio erhalten massive KI-Beschleunigung mit bis zu 512 GB Unified Memory und 1,2 TB/s Bandbreite.

OpenAI Jalapeño: Erste Benchmark-Ergebnisse für den eigenen Inferenz-Chip
Bis zu 1,9-mal mehr Arbeit pro Watt und 3,6-mal niedrigere Latenz bei GPT-OSS, DeepSeek R1 und Kimi K2.5.

Perplexity Portable Computer:
Lokale KI-Agenten ohne Token-Kosten und Cloud-Zwang
Mit maßgeschneidertem PPLX 27B und NVIDIA-Kooperation bringt Perplexity autonome Agenten-Workflows nativ auf den Desktop.

World Humanoid Robot Games:
Wenn Roboter Weltrekorde jagen
Bei den Spielen in Peking unterbieten humanoide Sprinter erstmals menschliche Bestzeiten – und offenbaren das ungelöste Brems-Problem.

Neue Claude-Modelle im Anflug:
Warum Anthropic bei Opus, Sonnet und Haiku nachbessern muss
Spekulationen um Opus 5.1, schwächelnde Alltagswerte und der strategische Spagat zu Fable 5.

Claude Academy: Anthropic startet kostenlose Lernplattform für Agenten, MCP und AI Fluency
Vom 4D-Framework bis zu Subagenten und Claude Code: 289 Kurse, Tutorials und Use Cases für Einsteiger, Entwickler und Teams.

Nous Research kontert Grok Bot:
Hermes Bot Mode bringt Open-Source-Agententeams auf den Desktop
Nach dem Hype um xAIs Grok Bot antwortet die Open-Source-Community mit Multi-Agenten-Rostern, Bot-to-Bot-Kommunikation und freier Modellwahl.

Anthropic legt Claude-Wasserzeichen offen:
So funktioniert das unsichtbare SynthID-Signal
Warum der Text für Menschen unverändert bleibt, wie der Pseudo-Zufall gesteuert wird und wo Grenzen bei Code und Fakten liegen.

Qwen 3.8-27B zum Download freigegeben:
Open-Weights-Modell mit Linear-Hybrid-Attention und Vision-Tower
Alibaba stellt die Modellgewichte für lokale Inferenz bereit - mit 48 linearen Schichten für minimalen KV-Cache und MTP-Beschleunigung.

GLM-5.3 und ZCode: Zhipu AI zündet nächste Stufe im Agentic Coding
Mit 50 Prozent mehr Coding-Leistung, SOTA auf Terminal-Bench 3.0 und nativer ZCode-Integration greift Z.ai an.

750 Tokens pro Sekunde:
OpenAI startet Ultrafast-Modus auf Cerebras-Hardware
Mit Wafer-Scale-Prozessoren läuft GPT-5.6 Sol bis zu 14-mal schneller als im Standard-API-Tier.

Grok-Transformer und 40x-Faktor für Shares:
X legt "Für dich"-Algorithmus und Ranking-Gewichte offen
Die Open-Source-Veröffentlichung enthüllt, wie Posts gerankt werden, warum Reports die Sichtbarkeit zerstören und welche internen Labels X vergibt.

Gemini 3.7 Flash: Neues Coding-Arbeitspferd halbiert Token-Preise – und heizt Spekulationen um Gemini 3.5 Pro an
Nur drei Wochen nach Version 3.6 bringt Google ein gezieltes Agenten- und Programmier-Update. Während Flash-Modelle in Rekordzeit iterieren, verdichten sich die Anzeichen für das Ende von 3.5 Pro zugunsten von Gemini 4.

SpaceXAI legt nach Grok Bot mit Grok 4.6 nach:
Neues Modell auf Frontier-Niveau
Nur einen Tag nach dem Agenten-Betriebssystem folgt xAIs neues Flaggschiff: Grok 4.6 bringt Selbstverifizierung bei langen Aufgaben, schneidet beim Artificial Analysis Index auf Augenhöhe mit GPT-5.6 Sol ab und Elon Musk kündigt bereits Grok 4.7 für September an.

Platz 2 auf der Arena:
Microsoft attackiert Google und Meta mit MAI-Image 2.6
Zusammen mit dem 75 Prozent günstigeren MAI-Code 1.1 Flash zieht Mustafa Suleyman das Tempo bei Microsofts hauseigenen KI-Modellen an.

Grok Bot: SpaceXAI bringt KI-Kollegen mit eigenem Cloud-PC
Von Chatbots zu autonomen Arbeitsgruppen: Wie xAIs neue Bot-Flotte 24/7 im Hintergrund Aufgaben erledigt.

NVIDIA Nemotron 3.5 Lightning 30B:
3B aktive Parameter für lokale KI-Agenten
Das neue offene MoE-Mamba-Modell setzt auf NVFP4-Quantisierung und 1 Million Token Kontext für Desktop- und Edge-Systeme.

Meta Muse Glimmer: Erster lokaler KI-Agent mit Claude-Cowork-Usability?
Das 30B-Modell erreicht laut Benchmarks Gemini 3.5 Flash-Niveau und läuft dank Unsloth und LM Studio lokal auf Mac und PC.

25 Jahre altes MIMO-Rätsel gelöst:
KI knackt ungelöstes Mobilfunk-Problem
GPT-5.6 und Claude Fable beweisen, dass die mathematische Höchstgrenze der MIMO-Signalrekonstruktion in polynomeller Zeit erreichbar ist – ohne Rechenzeit-Kluft.