Modelle & Agenten

Nous Research kontert Grok Bot:
Hermes Bot Mode bringt Open-Source-Agententeams auf den Desktop
Nach dem Hype um xAIs Grok Bot antwortet die Open-Source-Community mit Multi-Agenten-Rostern, Bot-to-Bot-Kommunikation und freier Modellwahl.

Anthropic legt Claude-Wasserzeichen offen:
So funktioniert das unsichtbare SynthID-Signal
Warum der Text für Menschen unverändert bleibt, wie der Pseudo-Zufall gesteuert wird und wo Grenzen bei Code und Fakten liegen.

Qwen 3.8-27B zum Download freigegeben:
Open-Weights-Modell mit Linear-Hybrid-Attention und Vision-Tower
Alibaba stellt die Modellgewichte für lokale Inferenz bereit - mit 48 linearen Schichten für minimalen KV-Cache und MTP-Beschleunigung.

GLM-5.3 und ZCode: Zhipu AI zündet nächste Stufe im Agentic Coding
Mit 50 Prozent mehr Coding-Leistung, SOTA auf Terminal-Bench 3.0 und nativer ZCode-Integration greift Z.ai an.

750 Tokens pro Sekunde:
OpenAI startet Ultrafast-Modus auf Cerebras-Hardware
Mit Wafer-Scale-Prozessoren läuft GPT-5.6 Sol bis zu 14-mal schneller als im Standard-API-Tier.

Grok-Transformer und 40x-Faktor für Shares:
X legt "Für dich"-Algorithmus und Ranking-Gewichte offen
Die Open-Source-Veröffentlichung enthüllt, wie Posts gerankt werden, warum Reports die Sichtbarkeit zerstören und welche internen Labels X vergibt.

Gemini 3.7 Flash: Neues Coding-Arbeitspferd halbiert Token-Preise – und heizt Spekulationen um Gemini 3.5 Pro an
Nur drei Wochen nach Version 3.6 bringt Google ein gezieltes Agenten- und Programmier-Update. Während Flash-Modelle in Rekordzeit iterieren, verdichten sich die Anzeichen für das Ende von 3.5 Pro zugunsten von Gemini 4.

SpaceXAI legt nach Grok Bot mit Grok 4.6 nach:
Neues Modell auf Frontier-Niveau
Nur einen Tag nach dem Agenten-Betriebssystem folgt xAIs neues Flaggschiff: Grok 4.6 bringt Selbstverifizierung bei langen Aufgaben, schneidet beim Artificial Analysis Index auf Augenhöhe mit GPT-5.6 Sol ab und Elon Musk kündigt bereits Grok 4.7 für September an.

Platz 2 auf der Arena:
Microsoft attackiert Google und Meta mit MAI-Image 2.6
Zusammen mit dem 75 Prozent günstigeren MAI-Code 1.1 Flash zieht Mustafa Suleyman das Tempo bei Microsofts hauseigenen KI-Modellen an.

Grok Bot: SpaceXAI bringt KI-Kollegen mit eigenem Cloud-PC
Von Chatbots zu autonomen Arbeitsgruppen: Wie xAIs neue Bot-Flotte 24/7 im Hintergrund Aufgaben erledigt.

NVIDIA Nemotron 3.5 Lightning 30B:
3B aktive Parameter für lokale KI-Agenten
Das neue offene MoE-Mamba-Modell setzt auf NVFP4-Quantisierung und 1 Million Token Kontext für Desktop- und Edge-Systeme.

Meta Muse Glimmer: Erster lokaler KI-Agent mit Claude-Cowork-Usability?
Das 30B-Modell erreicht laut Benchmarks Gemini 3.5 Flash-Niveau und läuft dank Unsloth und LM Studio lokal auf Mac und PC.

Anthropic kennzeichnet Claude-Texte und Dateien mit unsichtbarem Wasserzeichen - aber wie funktioniert das eigentlich?
Was der EU AI Act vorschreibt, wer den Kodex unterzeichnet hat, wie die Technik funktioniert und was ein gefundenes Wasserzeichen beweist

Mona-Lisa-1: OpenAIs geheimnisvolles Bildmodell in der Arena gesichtet
Ein unangekündigtes Modell sorgt in den Arena-Matches für Furore. Erste Tests zeigen SynthID-Wasserzeichen und deutliche Sprünge bei Typografie und Fotorealismus.

Alibaba stellt Video-Modell Wan 3 vor:
Konkurrenz für Seedance 2.5 und FLUX 3
Mit Wan 3 bringt Alibaba ein multimodales KI-Videomodell mit synchronem Audio, Omni-Modal Reference und 30-Sekunden-Generierung auf Qwen Cloud.

Luna für alle: OpenAI macht GPT-5.6 kostenlos unlimitiert - und bringt den Denk-Slider
Das schlanke Modell Luna wird Standard für alle Gratis-Nutzer. Dazu gibt es unbegrenzten Text-Chat, einen Denk-Knopf und stufenlose Reasoning-Regler für Zahlkunden.

Meta bläst zur KI-Aufholjagd:
Muse-Code und Muse-Spark 1.2 vorgestellt
Meta AI Research bringt neuen Terminal-Coding-Agenten mit persistenten Subagenten und absturzsicherem Event-Log.

Prime Agent: Prime Intellect bringt Open-Source Agent Framework
Neuer RLM-Agent kombiniert rekursiven Python-Kernel mit Continual Harness und schlägt die ARC-AGI-3-Mensch-Baseline.

Liquid AI LFM 2.5: Der 2,6-Milliarden-Agent für das Smartphone
Neues On-Device-Modell kombiniert Hybrid-Architektur mit vierstufigem Post-Training für lokale Automatisierung.

Mathematik in der WTF-Phase:
Wie KI das Forschungstempo explodieren lässt
Zehn neue Ergebnisse zu langjährigen offenen Problemen, rund 2.000 Dollar Tokenkosten und nur Monate zwischen den Fähigkeitssprüngen - Astra zeigt, wie rasant KI wissenschaftliche Arbeit verändert.