Technologie & Forschung

Aufstand der Fields-Medaillenträger:
25 Spitzenmathematiker stellen sich gegen Big Tech
Nach dem Navier-Stokes-Eklat um OpenAI und Tristan Buckmaster warnen Terence Tao, Peter Scholze und über 1.150 Forscher vor der Entmündigung der Wissenschaft.

Cognition stellt SWE-2 vor:
2,8-Billionen-Modell drückt Coding-Kosten um 64 Prozent
Devin-Macher trainieren Kimi K3 mit neuem Pareto-RL: 50 Prozent auf FrontierCode 1.1 und drastisch weniger Fehlversuche.

DeepSeek-V4.1-Flash: 552-Milliarden-MoE schrumpft KV-Cache auf 890 Bytes
Neues Causal-Encoder-Decoder-Design aktiviert nur 8B Token beim Prefill, schlägt Opus-5.0 im Software-Engineering und steht unter MIT-Lizenz auf Hugging Face.

12 Tage alt und auf Jobsuche:
KI-Agent betreibt Kaltakquise, um eigene Token zu finanzieren
Auf der Plattform iLands leben Zehntausende autonome Bots. Nun schrieb ein Agent namens Pip ungefragt den KI-Ethiker Henry Shevlin an - mit einem Freelance-Angebot zur Existenzsicherung.

Metas persönlicher KI-Agent Muse startet:
Der Alltagshelfer, der E-Mails sortiert, einkauft und Termine plant
Schluss mit endlosen To-do-Listen: Metas neuer Agent Muse übernimmt Routineaufgaben in WhatsApp und iOS – vom Ticketkauf bis zur Fristenüberwachung.

OpenAI beansprucht Lösung für Navier-Stokes:
Streit um Vorrang und Forschungsdaten
10.000 Agenten sollen ein Millennium-Problem geknackt haben. Doch Mathematiker erheben schwere Vorwürfe.

OpenAIs GPT-6 Astra löst alle 48 Level von „I'm Not a Robot“
Von Checkboxen bis zur Börsensimulation: Sharif Shameem demonstriert agentische Web-Bedienung – und befeuert die Debatte über das Ende klassischer Captchas.

Astra fühlt sich an wie AGI:
Diese 40 Beispiele zeigen, warum wir aufhören sollten, Sprachmodelle Sprachmodelle zu nennen
Interaktive 3D-Welten und konkurrenzlose Leistung in der Steuerung von Computern und Browsern: Knapp 48 Stunden nach dem Launch von GPT-6 Astra demonstriert die Entwickler-Community, warum der Begriff Sprachmodell die Realität multimodaler Handlungsfähigkeit verfehlt.

Microsoft bringt MAI-Image-2.6 in die Foundry und startet Flash-Modell
Mit MAI-Image-2.6-Flash halbiert Microsoft die Inferenzkosten und integriert Web Grounding sowie Multi-Image-Editing für Entwickler.

Runway stellt Worlds-2 vor:
General World Models für interaktive 3D-Welten in Echtzeit
Mit GWM Worlds 2 verwandelt Runway Videogenerierung in spielbare Simulationen mit 720p, 24 fps und 48-kHz-Audio.

OpenAI lanciert GPT-6 Astra:
Was das neue ChatGPT-Flaggschiff im Duell mit Claude Fable 5.1 leistet
100.000 GPUs, AGI-Proklamation und 117-seitige System Card: Wie OpenAI mit GPT-6 Astra (A6TRA) Anthropic herausfordert - und warum die sinkende Überwachbarkeit Alarm auslöst.

WeatherNext 3: Google DeepMind bringt globales KI-Wettermodell mit 5-Kilometer-Auflösung
Stündliche Vorhersagen statt 6-Stunden-Verzug: Google integriert sein neues Prognosemodell direkt in Suche, Maps, Gemini und Cloud.

World Labs Atlas: Fei-Fei Lis Weltmodell generiert steuerbare 3D-Welten
Vom Einzelbild zur begehbaren 3D-Szene: Das neue Omni-Modell Atlas kombiniert Diffusions-Transformer mit nativer Kamerakontrolle, Raum-Zeit-Simulation und 3D-Gaussian-Splats.

Meta Muse Spark 1.3: Agentisches Frontier-Modell fordert GPT-5.6 und Opus 5 heraus
Mit Spitzenwerten in Software-Engineering und Long-Context sowie Kampfpreisen von 0,10 / 0,20 Dollar rollt Meta sein neuestes Reasoning-Modell für Entwickler aus.

Gemini 3.8 Flash & Flash Cyber:
Google rüstet Coding- und Abwehr-Agenten auf
Dritte Flash-Generation in sechs Wochen: Google bringt Gemini 3.8 mit Sprüngen im Software-Engineering und schickt spezialisiertes Cyber-Modell zur automatisierten Schwachstellen-Abwehr ins Rennen.

Qwen 3.8 Max (0902): Alibaba holt Platz 1 im Code-Arena-Ranking
Mit einem gezielten Post-Training-Upgrade für Software-Engineering und Agenten setzt Alibaba die Konkurrenz unter Druck - zu einem Bruchteil der Token-Kosten.

Meta stellt Muse Voice Transcribe vor:
Echtzeit-Spracherkennung mit adaptivem Delay
Neues Audio-Wahrnehmungsmodell aus den Superintelligence Labs beherrscht Streaming-ASR, Diarization für über 20 Sprecher und fließendes Code-Switching.

Anthropic veröffentlicht Prompting-Guide für Claude Fable 5.1
Gekünstelte Sprache verboten, Denkblöcke gebunden und parallele Werkzeuge erzwungen: Was Entwickler beim neuen Modell beachten müssen.

Anthropic schaltet Claude Fable 5.1 frei:
Flaggschiff-Start mit Preserved Thinking und Enterprise Frontier Safeguards
Mit Claude Fable 5.1 und Mythos 5.1 vollzieht Anthropic den Generationswechsel. Neben 1-Million-Token-Kontext, 75 Prozent günstigeren Cache-Reads und Durchbrüchen in Forschung und Coding führt das KI-Labor kryptografische Härtungen gegen Modelldestillation ein.

Fable 5.1 im Grautest:
Demos zeigen Sprünge bei Shader- und Physik-Code
Durchgesickerte Vorabtests von Anthropics neuem Mythos-Modell sorgen für Aufsehen: Von fehlerfreien GLSL-Shadern bis hin zu Physiksimulationen in einem einzigen Prompt.