Technologie & Forschung

Claude Opus 5 ist da:
Wie viel Flaggschiff-Leistung gibt es zum niedrigeren Preis?
Anthropic nennt bessere Ergebnisse in ausgewählten Tests und senkt den Preis gegenüber Opus 4.5. Community-Demos zeigen einzelne Anwendungen, ersetzen aber keinen unabhängigen Vergleich.

Denken durch Sprechen:
Anthropic und OpenAI rüsten KI-Voice-Modi für komplexe Probleme auf
Claude Voice unterstützt jetzt Opus, Sonnet und Tool-Calling, während OpenAI Sprachsteuerung im Desktop-Agenten ausrollt: Wie Entwickler Voice als neuen Denkmodus entdecken.

Anthropic vor Claude Opus 5 Launch:
3D-Generierung glänzt in ersten Demos
Gerüchte sprechen von Fable-5-Performance zum halben Preis: KI-Tester teilen beeindruckende 3D-Szenen und WebGL-Animationen aus Betatests.

Erdős-Probleme fallen in Serie:
KI-Systeme lösen jahrzehntealte Mathe-Rätsel
Lean-basierter Ansatz erbringt formale Beweise für ungelöste Probleme von Paul Erdős.

Block stellt Buzz vor:
Open-Source-Plattform für Mensch-KI-Kollaboration auf Nostr
Jack Dorseys Unternehmen entwickelt Workspace-Alternative, in der KI-Agenten mit eigener kryptografischer Identität als gleichberechtigte Teammitglieder agieren.

Claude Code Desktop erhält native iOS-Simulator-Integration
Anthropic erweitert die Desktop-App um ein interaktives Vorschaufenster: Entwickler können KI-gestützte Tests von iOS-Apps live verfolgen und selbst eingreifen.

Gemini 3.6 Flash: Google schärft Effizienz und kündigt Gemini 4 an
Gemini 3.6 Flash benötigt laut Google weniger Ausgabe-Token und verbessert einzelne Agenten-Benchmarks. Zugleich ist das Pre-Training für Gemini 4 bereits gestartet.

Washington-Briefing: Ist das schon GPT-6? Was bestätigt ist und was Gerücht bleibt
Altman informiert Washington über eine kommende Modellfamilie. In der Community kursieren zugleich unbestätigte Angaben zu GPT-6, möglichen Terminen und neuen Fähigkeiten.

Enthauptung im Ring: T800 verliert Kopf bei Roboter-MMA und bewegt sich weiter
Beim URKL-Auftakt in Shenzhen löste ein Drehkick den Kopf eines T800. Ort, Plattform und Teilnehmerfeld sind bestätigt; der genaue Autonomiegrad des Kampfes ist nicht öffentlich dokumentiert.

Qwen 3.8 Max offiziell lanciert:
SOTA-Hype oder „benchmaxxed Slop“?
Alibabas öffentlich testbares Spitzenmodell polarisiert die Entwicklergemeinde. Die Preview ist offiziell gestartet und auf chat.qwen.ai verfügbar - doch die ersten Meinungen gehen weit auseinander.

Kimi K3 in der Praxis:
starke Frontend-Demos, offene Fragen bei Legal und Betrieb
Community-Tests zeigen Webseiten, Spiele und Vertragsanalysen. Die Beispiele sind vielversprechend, ersetzen aber keine kontrollierten Qualitäts-, Sicherheits- und Verfügbarkeitstests.

Kimi K3 startet als Dienst und API:
Gewichte für 2,8-Billionen-Modell angekündigt
Moonshot macht Kimi K3 über seine Dienste und API verfügbar. Die vollständigen Open-Weight-Dateien waren für spätestens 27. Juli angekündigt; insgesamt ordnet der Hersteller K3 hinter Fable 5 und GPT-5.6 Sol ein.

Inkling: Thinking Machines Lab veröffentlicht erstes Open-Weight-Modell
Inkling bietet 975 Milliarden Gesamtparameter, 41 Milliarden aktive Parameter, multimodale Eingaben und steuerbaren Denkaufwand. Die offenen Gewichte erfordern sehr große GPU-Systeme.

Vom Kivine-Gerücht zum Kimi-K3-Launch:
Was bestätigt wurde
Die Community vermutete Kimi K3 hinter einem Arena-Modell. Bestätigt sind später 2,8 Billionen Parameter, eine Million Token Kontext und die Verfügbarkeit über Kimi-Dienste und API.

Bonsai 27B: Das erste 27-Milliarden-Modell läuft auf dem Smartphone
PrismML komprimiert Qwen 3.6 27B auf 3,9 GB. Laut Hersteller behält die 1-Bit-Variante mehr als 90 Prozent und die ternäre Variante mehr als 95 Prozent der Vergleichsleistung.

GPT-5.6 Sol beeindruckt im ersten Härtetest - und OpenAI stellt mit ChatGPT Work neuen Agenten vor
Die KI Woche hat die ersten Beispiele zu GPT-5.6 Sol und verrät, warum GPT-6 Gerüchten zufolge bereits in wenigen Wochen folgen könnte.

Grok 4.5: SpaceXAI und Cursor gelingt das günstigste Frontier-Coding-Modell
Mixture-of-Experts auf GB300-GPUs, 80 TPS, Platz 1 im Harvey Legal Benchmark — und das günstigste Frontier-Modell am Markt.

GPT-5.6 Sol startet Donnerstag - und Fable 5 bleibt die Nummer 1
OpenAI weitet den Preview-Zugang global aus. Frühe Tester sind sich einig: Gutes Modell, aber Anthropics Fable 5 liegt weiterhin vorn.

Anthropics J-Space: Wie Claude einen mentalen Arbeitsbereich entwickelt hat
Anthropics Interpretability-Team entdeckt in Claude einen privilegierten internen Raum für stilles Denken - mit weitreichenden Folgen für KI-Sicherheit.

Higgsfield Supercomputer kann jetzt Full-Stack-Apps und Spiele bauen
Bild- und Videoplattform wird zur universellen KI-Entwicklungsumgebung: Apps mit Frontend, Backend und Datenbank - plus eine eigene Gaming-Pipeline.