Modelle & Agenten

Ollama bringt lokale Modelle in Claude Desktop
Anthropic und Ollama ermöglichen direkte Integration lokaler Open-Source-Modelle über Third-Party-Gateway.

GLM 5.3 Flash und Qwen 3.8 Flash Next:
Chinas Doppel-Angriff auf die High-Speed-Klasse
Zhipu AI lüftet das Geheimnis um Ox Alpha, während Alibaba mit N-Gram-Embeddings und Sparse-Linear-Hybriden die Qwen4-Architektur einläutet.

Claude Fable 5.1 kurz vor dem Start? Wettquoten und Leaks heizen Gerüchte um neues Anthropic Flaggschiff an
Auf Polymarket wetten Trader zwischenzeitlich zu über 50 Prozent auf einen Launch bis Ende August - während Sicherheitsfortschritte und Community-Hinweise auf ein baldiges Mythos-Update deuten.

OpenAI Jalapeño: Erste Benchmark-Ergebnisse für den eigenen Inferenz-Chip
Bis zu 1,9-mal mehr Arbeit pro Watt und 3,6-mal niedrigere Latenz bei GPT-OSS, DeepSeek R1 und Kimi K2.5.

Perplexity Portable Computer:
Lokale KI-Agenten ohne Token-Kosten und Cloud-Zwang
Mit maßgeschneidertem PPLX 27B und NVIDIA-Kooperation bringt Perplexity autonome Agenten-Workflows nativ auf den Desktop.

Neue Claude-Modelle im Anflug:
Warum Anthropic bei Opus, Sonnet und Haiku nachbessern muss
Spekulationen um Opus 5.1, schwächelnde Alltagswerte und der strategische Spagat zu Fable 5.

Ox Alpha: Mysteriöses neues KI-Modell mischt Entwicklerszene auf
Spekulationen um Fable-Überlegenheit, GLM 5.3 Flash vs. GLM 5.5, Kimi K3.1 und die umstrittene Alltagsleistung.

Claude Academy: Anthropic startet kostenlose Lernplattform für Agenten, MCP und AI Fluency
Vom 4D-Framework bis zu Subagenten und Claude Code: 289 Kurse, Tutorials und Use Cases für Einsteiger, Entwickler und Teams.

Nous Research kontert Grok Bot:
Hermes Bot Mode bringt Open-Source-Agententeams auf den Desktop
Nach dem Hype um xAIs Grok Bot antwortet die Open-Source-Community mit Multi-Agenten-Rostern, Bot-to-Bot-Kommunikation und freier Modellwahl.

Anthropic legt Claude-Wasserzeichen offen:
So funktioniert das unsichtbare SynthID-Signal
Warum der Text für Menschen unverändert bleibt, wie der Pseudo-Zufall gesteuert wird und wo Grenzen bei Code und Fakten liegen.

Qwen 3.8-27B zum Download freigegeben:
Open-Weights-Modell mit Linear-Hybrid-Attention und Vision-Tower
Alibaba stellt die Modellgewichte für lokale Inferenz bereit - mit 48 linearen Schichten für minimalen KV-Cache und MTP-Beschleunigung.

GLM-5.3 und ZCode: Zhipu AI zündet nächste Stufe im Agentic Coding
Mit 50 Prozent mehr Coding-Leistung, SOTA auf Terminal-Bench 3.0 und nativer ZCode-Integration greift Z.ai an.

750 Tokens pro Sekunde:
OpenAI startet Ultrafast-Modus auf Cerebras-Hardware
Mit Wafer-Scale-Prozessoren läuft GPT-5.6 Sol bis zu 14-mal schneller als im Standard-API-Tier.

Grok-Transformer und 40x-Faktor für Shares:
X legt "Für dich"-Algorithmus und Ranking-Gewichte offen
Die Open-Source-Veröffentlichung enthüllt, wie Posts gerankt werden, warum Reports die Sichtbarkeit zerstören und welche internen Labels X vergibt.

Gemini 3.7 Flash: Neues Coding-Arbeitspferd halbiert Token-Preise – und heizt Spekulationen um Gemini 3.5 Pro an
Nur drei Wochen nach Version 3.6 bringt Google ein gezieltes Agenten- und Programmier-Update. Während Flash-Modelle in Rekordzeit iterieren, verdichten sich die Anzeichen für das Ende von 3.5 Pro zugunsten von Gemini 4.

SpaceXAI legt nach Grok Bot mit Grok 4.6 nach:
Neues Modell auf Frontier-Niveau
Nur einen Tag nach dem Agenten-Betriebssystem folgt xAIs neues Flaggschiff: Grok 4.6 bringt Selbstverifizierung bei langen Aufgaben, schneidet beim Artificial Analysis Index auf Augenhöhe mit GPT-5.6 Sol ab und Elon Musk kündigt bereits Grok 4.7 für September an.

Platz 2 auf der Arena:
Microsoft attackiert Google und Meta mit MAI-Image 2.6
Zusammen mit dem 75 Prozent günstigeren MAI-Code 1.1 Flash zieht Mustafa Suleyman das Tempo bei Microsofts hauseigenen KI-Modellen an.

Grok Bot: SpaceXAI bringt KI-Kollegen mit eigenem Cloud-PC
Von Chatbots zu autonomen Arbeitsgruppen: Wie xAIs neue Bot-Flotte 24/7 im Hintergrund Aufgaben erledigt.

NVIDIA Nemotron 3.5 Lightning 30B:
3B aktive Parameter für lokale KI-Agenten
Das neue offene MoE-Mamba-Modell setzt auf NVFP4-Quantisierung und 1 Million Token Kontext für Desktop- und Edge-Systeme.

Meta Muse Glimmer: Erster lokaler KI-Agent mit Claude-Cowork-Usability?
Das 30B-Modell erreicht laut Benchmarks Gemini 3.5 Flash-Niveau und läuft dank Unsloth und LM Studio lokal auf Mac und PC.