Technologie & Forschung

GPT-5.6 Sol beeindruckt im ersten Härtetest - und OpenAI stellt mit ChatGPT Work neuen Agenten vor
Die KI Woche hat die ersten Beispiele zu GPT-5.6 Sol und verrät, warum GPT-6 Gerüchten zufolge bereits in wenigen Wochen folgen könnte.

Grok 4.5: SpaceXAI und Cursor gelingt das günstigste Frontier-Coding-Modell
Mixture-of-Experts auf GB300-GPUs, 80 TPS, Platz 1 im Harvey Legal Benchmark — und das günstigste Frontier-Modell am Markt.

GPT-5.6 Sol startet Donnerstag - und Fable 5 bleibt die Nummer 1
OpenAI weitet den Preview-Zugang global aus. Frühe Tester sind sich einig: Gutes Modell, aber Anthropics Fable 5 liegt weiterhin vorn.

Anthropics J-Space: Wie Claude einen mentalen Arbeitsbereich entwickelt hat
Anthropics Interpretability-Team entdeckt in Claude einen privilegierten internen Raum für stilles Denken - mit weitreichenden Folgen für KI-Sicherheit.

Higgsfield Supercomputer kann jetzt Full-Stack-Apps und Spiele bauen
Bild- und Videoplattform wird zur universellen KI-Entwicklungsumgebung: Apps mit Frontend, Backend und Datenbank - plus eine eigene Gaming-Pipeline.

Claude Cowork kommt für Web und Mobile - und Fable 5 geht in die Verlängerung
Anthropic macht seine KI-Agenten plattformunabhängig und verlängert den kostenlosen Fable-5-Zugang für alle Abonnenten bis 12. Juli.

LongCat 2.0: Meituans 1,6-Billionen-Parameter-Modell lief zwei Monate unerkannt auf OpenRouter
Open Source, MIT-Lizenz, trainiert auf chinesischen Chips. In Community-Tests auf Augenhöhe mit Opus 4.8 und GPT-5.5.

Googles Aufholjagd: Leaks und Gerüchte um Gemini 3.5 Pro verdichten sich
Interne API-Einträge, Arena-Tests und ein Polymarket-Wettmarkt deuten auf einen Launch am 17. Juli. Die ersten Ergebnisse sehen stark aus.

Remote Labor Index: KI-Agenten automatisieren jetzt sechsmal mehr Freelance-Arbeit als vor acht Monaten
Das Center for AI Safety misst erstmals einen massiven Sprung: Fable 5 erreicht 16,1 Prozent Automatisierungsrate bei echten Freelance-Projekten — noch im Oktober waren es 2,5 Prozent.

Prompt Engineering ist tot — Anthropics Fable-5-Guide definiert die Regeln neu
Vergiss 'Think step by step': Anthropics offizielle Prompting-Anleitung für Fable 5 zeigt, wie radikal sich der Umgang mit KI-Modellen verändert hat.

Agents-A1: Wie ein 35-Milliarden-Modell Billionen-Parameter-Giganten schlägt
Nicht größer, sondern weiter denken: Shanghais KI-Labor zeigt, dass ein 35B-Agent mit längeren Reasoning-Trajektorien die Performance von 1-Billionen-Parameter-Modellen erreicht.

Isaac 1: Weave Robotics bringt den ersten mobilen Haushaltsroboter für 449 Dollar im Monat
Das San-Francisco-Startup liefert ab Herbst 2026 einen Roboter, der Wäsche faltet, Betten macht und Kinderspielzeug wegräumt. Preis: 7.999 Dollar oder ein Abo für 449 Dollar monatlich.

Claude Science: Anthropics KI-Workbench macht Forscher zu Zehnfach-Wissenschaftlern
Von Protein-Faltung bis Literatur-Review: Anthropic veröffentlicht eine Desktop-App, die über 60 wissenschaftliche Datenbanken und NVIDIAs BioNeMo in eine einzige Forschungsumgebung packt — mit vollständiger Reproduzierbarkeit.

ZCode 3.0: Zhipu AIs Coding-IDE macht GLM-5.2 zum Komplettpaket
Das chinesische KI-Labor verpackt sein Open-Weights-Topmodell in eine Desktop-App mit Multi-Agenten, Goal Mode und 1-Million-Token-Kontext. Cursor und Claude Code bekommen Konkurrenz aus Peking.

Claude Sonnet 5 unter der Lupe:
Effizienter als Opus und doch überraschend teuer
Die Community testet Anthropics neues Standardmodell. Das Bild ist differenziert: In manchen Benchmarks überlegen, bei den realen Kosten aber eine Überraschung.

Etched liefert den Sohu-Chip:
Ein ASIC nur für Transformer-Inferenz
Der Spezialprozessor auf TSMCs 4nm-Verfahren soll 500.000 Tokens pro Sekunde schaffen und wird ab Sommer 2026 ausgeliefert. Bewertung: 5 Milliarden Dollar.

Keine Spur von Gemini 3.5 Pro:
Google DeepMind hält die Spannung
Trotz wochenlanger Leaks und Benchmark-Hinweise bleibt Googles nächstes Frontier-Modell unsichtbar - während die Konkurrenz im Stundentakt liefert.

Sonnet 5 ist da: Kannibalisiert Anthropic sein leistungsstarkes Opus 4.8 Modell?
Das agentischste Sonnet aller Zeiten kommt nah an Opus heran - zu deutlich niedrigeren Preisen. Für viele verschwimmt die Grenze zwischen günstig und leistungsstark.

OpenClaw startet native Apps für iOS und Android
Der Open-Source-KI-Agent von Peter Steinberger läuft jetzt direkt auf dem Smartphone - als Companion für das eigene Gateway.

Brain2Qwerty v2: Metas KI liest Gedanken ohne OP - und schafft 78 Prozent Genauigkeit
Neun Probanden, zehn Stunden MEG-Aufnahmen, 22.000 Sätze: Ein nicht-invasives System dekodiert erstmals ganze Sätze aus Hirnwellen mit einer Trefferquote, die bisher nur chirurgischen Implantaten vorbehalten war.