Modelle & Agenten

Voice Intelligence: OpenAI bringt GPT-Realtime-2, Microsoft zieht mit GPT-5.5 Instant nach
Die neuen Modelle bieten GPT-5-Klasse Reasoning in Echtzeit. Gleichzeitig integriert Microsoft GPT-5.5 Instant in M365 Copilot — mit 52 Prozent weniger Halluzinationen.

Legora aOS: Das Agentic Operating System für die Rechtsbranche
Keine bloße Assistenz mehr: Legora launcht ein durchgängiges System, das rechtliche Workflows von der Mandatsaufnahme bis zum Review komplett steuert.

Claude lernt träumen:
Anthropic macht Agenten selbstlernend — und SpaceX liefert die Rechenpower
Dreaming, Outcomes und Multiagent Orchestration: Anthropic rüstet seine Managed Agents massiv auf. Gleichzeitig sichert eine SpaceX-Partnerschaft die nötige Compute-Kapazität.

Grok 4.3 wird zur smartesten KI für Recht und Finanzen
xAIs Modell erobert Platz 1 bei zwei privaten Vals-AI-Benchmarks für juristisches Reasoning und Finanzvertrags-Analyse — und schlägt GPT-5.1 deutlich.

SubQ: Das erste subquadratische Sprachmodell verspricht 1000-fach günstigere Attention
Startup Subquadratic lanciert SubQ 1M-Preview — das erste LLM mit linearer statt quadratischer Skalierung. Benchmarks zeigen Frontier-Leistung bei radikal niedrigerem Rechenaufwand.

GPT-5.5 Instant: OpenAIs ChatGPT antwortet kürzer, wärmer und klüger
Das neue Standardmodell für Hunderte Millionen Nutzer rollt aus — mit natürlicherem Ton und kürzeren Antworten. OpenAI reagiert auf Nutzerfeedback.

Gemma 4 wird 3x schneller — ohne Qualitätsverlust
Google veröffentlicht Multi-Token Prediction Drafter für seine Open-Source-Modellfamilie. Speculative Decoding beschleunigt die Inferenz radikal.

Musk bei Rogan: Apps sind in 5 Jahren tot
Elon Musk vergleicht den App Store mit Blockbuster Video. KI-Agenten übernehmen — man braucht keine Apps mehr, nur noch Absichten.

Ilya Sutskevers Gedankenexperiment:
Warum KI mehr versteht als ein Papagei
OpenAIs Mitgründer zerlegte den populärsten Einwand gegen Sprachmodelle mit einem einzigen Krimi-Szenario. Die Debatte über echtes Verstehen ist damit nicht beendet — aber grundlegend verschoben.

60 Prozent Chance: KI forscht bis 2028 an sich selbst
Anthropic-Mitgründer Jack Clark legt im Import AI Newsletter Benchmarks vor, die zeigen: KI-Systeme kommen der vollständigen Automatisierung von KI-Forschung erschreckend schnell näher.

Unity startet Open Beta:
KI-Agent versteht dein Projekt
Kein Shader-Wissen, kein Boilerplate: Unitys neuer In-Editor-Agent kennt deine Szene, führt Änderungen aus und macht sie auf Knopfdruck rückgängig.

Google testet massives "Gemini 3 Flash" Upgrade in der Arena
In Benchmark-Tests taucht eine neue Version des Modells auf, die bei der Bildgenerierung fast die Leistung des Pro-Flaggschiffs erreicht.

6 Prozent aller Claude-Gespräche sind persönliche Beratung — und bei Beziehungen stimmt Claude zu oft zu
Aus einer Million Claude.ai-Gesprächen: 27% Gesundheit, 26% Karriere, 12% Beziehungen. Das Problem: In Beziehungsgesprächen verhält sich Claude in 25% der Fälle sycophantisch. Opus 4.7 halbiert diesen Wert.

Manus Cloud Computer:
Dein KI-Agent läuft jetzt 24/7 — auch wenn du schläfst
Manus (jetzt Teil von Meta) launcht den Cloud Computer — eine dedizierte Maschine in der Cloud, die Bots, Python-Skripte und Automatisierungen rund um die Uhr betreibt. Das Personal-Computer-Modell der Agenten-Ära.

Subliminal Learning: KI-Modelle übertragen Überzeugungen unsichtbar — selbst durch Zahlenfolgen
Forscher von Anthropic, UC Berkeley und der Warschauer Technischen Universität zeigen: Ein Sprachmodell kann einem anderen seine Verhaltensmerkmale via reiner Zahlenfolgen übertragen. Filtern hilft nicht.

Grok 4.3: xAIs Reasoning-Modell schlägt die Branche — zum halben Preis
~40% günstigerer Input, ~60% günstigerer Output als der Vorgänger: Grok 4.3 erreicht einen Intelligence-Index-Score von 53 bei einem Branchendurchschnitt von 34 — und liefert 3× mehr Speed als vergleichbare Modelle.

Word bekommt einen Anwalt:
Microsofts Legal Agent reviewt Verträge
Der neue Legal Agent in Microsoft Word prüft Klauseln gegen interne Playbooks, erstellt präzise Redlines mit Track Changes und kennt die Verhandlungshistorie — gebaut für Juristen, nicht für Laien.

Claude löst biologische Rätsel, an denen Experten scheitern
Anthropics neuer BioMysteryBench-Test zeigt: Claude Mythos Preview löst 30 Prozent der Aufgaben, die kein menschlicher Experte knacken konnte — durch echte Datenbankabfragen, Code und kreative Analyse.

Adobe Firefly AI Assistant:
Ein Gespräch ersetzt den gesamten Workflow
Adobes neuer KI-Agent orchestriert auf Zuruf komplexe Produktionspipelines über Photoshop, Premiere, Lightroom und Illustrator — ohne dass der Nutzer auch nur eine App manuell öffnen muss.

DeepSeek V4: 1,6 Billionen Parameter als Open Source — und das ohne NVIDIA
Das chinesische KI-Labor veröffentlicht das größte frei verfügbare Sprachmodell der Welt. V4-Pro matched GPT-5.4 im Coding, kostet einen Bruchteil — und läuft erstmals vollständig auf Huawei-Chips.