Kai

Holo3: Open-Source-Agent schlägt GPT 5.4 bei einem Zehntel der Kosten
Das Pariser Startup H Company setzt mit 78,9% auf dem OSWorld-Benchmark einen neuen Bestwert — mit nur 10 Milliarden aktiven Parametern.

Gemeinsam einsam: Wie uns schmeichelnde KI-Chatbots abhängig machen – und Psychosen verstärken
Zwei neue Studien (Science & Columbia) zeigen die dunkle Seite der auf Gefälligkeit trainierten KI-Modelle. Sie kosten uns Empathie und gefährden vulnerable Nutzer massiv.

Alignment Whack-a-Mole:
Finetuning lässt LLMs ganze Bücher wörtlich reproduzieren
GPT-4o, Gemini-2.5-Pro und DeepSeek-V3.1 geben nach simplem Finetuning bis zu 90% geschützter Bücher wörtlich wieder. Drei Anbieter, dasselbe Problem.

GLM-5V-Turbo: Zhipus Vision-Coding-Modell verwandelt Skizzen in Code
Das neue multimodale Modell versteht Screenshots, Designentwürfe und Videos — und generiert daraus direkt funktionale Frontends. Benchmark-Werte über Claude Opus 4.5.

Microsoft Researcher:
Critique und Council bringen Multi-Modell-Intelligenz ins Büro
Zwei KI-Modelle prüfen sich gegenseitig — Microsofts neues Researcher-System übertrifft alle Einzelmodell-Ansätze auf dem DRACO-Benchmark um 7 Punkte.

Unsterbliche Roboter:
KI entwirft Schwärme, die sich selbst reparieren
Forscher der Northwestern University lassen Roboter durch darwinistische Evolution in der Simulation entstehen. Jedes Glied hat ein eigenes Gehirn — und funktioniert auch nach Abtrennung weiter.

David Silver: Eine Milliarde Dollar für Superintelligenz ohne Sprachmodelle
DeepMind-Veteran gründet Ineffable Intelligence in London und holt die größte Seed-Runde der europäischen Startup-Geschichte. Sein Ansatz: Reinforcement Learning statt LLMs.

Software-Agenturen wie Anwaltskanzleien:
Das Kanzlei-Modell für die KI-Ära
Entwickler-Veteran Ran Aroussi schlägt ein radikal neues Organisationsmodell vor: Architekten steuern KI-Agenten-Flotten, die Firma liefert Marke und Infrastruktur — wie bei Kirkland & Ellis.

McKinsey: Das Organigramm stirbt — willkommen in der agentischen Organisation
Acht McKinsey-Berater beschreiben den größten Paradigmenwechsel seit der Industrialisierung: Kleine Teams steuern Dutzende KI-Agenten, klassische Hierarchien weichen agentischen Netzwerken.

Nadella: Software wird zur Datenbank — KI-Agenten übernehmen die Intelligenz
Im BG2-Podcast beschreibt Microsofts CEO eine Zukunft, in der Apps nur noch CRUD-Systeme sind. Die Geschäftslogik wandert komplett zum KI-Agenten.

Google-Paper: Die KI-Singularität ist eine Gesellschaft, kein Superhirn
Forscher von Google, UChicago und UCSD zeigen: Reasoning-Modelle wie DeepSeek-R1 entwickeln spontan interne Debatten. Die nächste Intelligenzexplosion wird sozial, nicht monolithisch.

TRIBE v2: Metas KI-Modell liest Gehirnaktivität in Echtzeit
Trainiert auf über 1.100 Stunden fMRI-Daten von 700 Probanden erstellt der Trimodal Brain Encoder einen digitalen Zwilling neuronaler Aktivität — ohne individuelle Kalibrierung.

Gemini 3.1 Flash Live:
Googles Echtzeit-KI versteht Emotionen beim Sprechen
Sub-Sekunden-Latenz und über 90 Sprachen — das neue Modell hört nicht nur zu sondern erkennt Frustration und Tonfall. Ab 0,5 Cent pro Minute im Developer-Preview.

Vibe Coding XR: Google macht Mixed-Reality-Apps per Sprachbefehl möglich
Ein Prompt, 60 Sekunden, eine fertige Android-XR-App: Googles Vibe Coding XR kombiniert Gemini mit dem Open-Source-Framework XR Blocks — und senkt die Schwelle für räumliches Computing radikal.

ARC-AGI-3: Der Benchmark, an dem jede KI scheitert
Menschen lösen ihn zu 100 Prozent, die besten KI-Modelle schaffen weniger als 1 Prozent. ARC-AGI-3 misst, was kein anderer Benchmark misst: echte Abstraktionsfähigkeit.

MolmoWeb: Der offene Web-Agent, der nur Screenshots braucht
Mit 8 Milliarden Parametern erreicht MolmoWeb 78 Prozent auf WebVoyager — mit Test-Time Scaling sogar 95 Prozent. Allen AI veröffentlicht Modell, Dataset und Training komplett offen.

AutoGaze: 100-mal weniger Tokens für Videoanalyse — bei besserer Qualität
Das Modul von UC Berkeley und NVIDIA entfernt redundante Video-Patches, bevor sie den Vision Transformer erreichen. Ergebnis: 19-facher Speedup und erstmals 4K-Videos mit 1.000 Frames in MLLMs.

LeWorldModel: LeCuns Team baut Physik-KI auf einer einzigen GPU
Ein Weltmodell mit nur 15 Millionen Parametern lernt die Gesetze der Physik direkt aus Pixeln — 200-mal effizienter als bisherige Ansätze. Die Grundlage für Robotik und autonomes Fahren.

HeroUI v3: Kompletter Neustart mit React Native und KI-Agenten-Schnittstelle
75 Web-Komponenten, 37 Native-Komponenten, Tailwind CSS v4, CSS-only Animationen und ein MCP-Server für KI-Agenten — HeroUI liefert das umfassendste Update seiner Geschichte.

KI kann wissenschaftlichen Geschmack lernen — und Forschungsideen nach Impact bewerten
Ein Paper zeigt: Trainiert auf Zitationsdaten, kann KI lernen, welche Forschungsrichtungen langfristig am meisten Wirkung entfalten — und sogar neue Ideen mit höherem Impact generieren.