Autonome KI-Agenten, die selbstständig Code schreiben, komplexe Recherchen durchführen und Dokumente analysieren, galten bisher als Domäne gigantischer Cloud-Rechenzentren. Mit Portable Computer vollzieht Perplexity nun einen bemerkenswerten Kurswechsel: Das Unternehmen hat eine Software-Plattform vorgestellt, die den gesamten Agenten-Stack lokal auf die Hardware der Nutzer bringt. Nach dem Start des Personal Computer für macOS und der Vision, Rechenzentren auf den Schreibtisch zu holen, zielt die neue Plattform primär auf Entwickler, datensensible Unternehmen und professionelle Anwender.

Die Kernidee von „Local-First“: Sämtliche Denkschritte, Dateizugriffe, Terminal-Befehle und Zwischenanalysen laufen direkt auf dem eigenen Rechner ab. Damit entfallen nicht nur die kontinuierlichen Token- und API-Kosten für jeden Arbeitsschritt, sondern vertrauliche Quellcodes und interne Geschäftsunterlagen verlassen zu keinem Zeitpunkt das lokale System.

Co-Design aus Agenten-Hülle und PPLX-27B-Modell

Für die Umsetzung kooperiert Perplexity eng mit dem Chiphersteller NVIDIA. Die Plattform startet ab sofort für den Desktop-Supercomputer NVIDIA DGX Spark (ausgestattet mit dem GB10 Grace-Blackwell-Superchip) sowie für Linux-Workstations mit NVIDIA-RTX-Grafikkarten, die über mindestens 24 Gigabyte Grafikspeicher (VRAM) verfügen. Eine Version für Windows-Systeme soll im September 2026 nachgereicht werden.

Technisch setzt Perplexity nicht auf starre Standardmodelle, sondern auf ein aufeinander abgestimmtes Zusammenspiel von Steuerungssoftware (Harness) und Sprachmodell. Neben dem offenen Qwen 3.8 27B kommt das speziell nachtrainierte Modell PPLX 27B zum Einsatz, das auf die Werkzeugnutzung, Code-Ausführung in lokalen Python-Sandboxes und Dateisystem-Navigation optimiert wurde. In Kürze soll zudem NVIDIAs offenes Modell Nemotron 3.5 Lightning (30B) im Modellauswahlmenü bereitstehen.

Konfiguration / Modell Agenten-Hülle Erfolgsquote (Benchmark) Cloud-Kosten pro Task
PPLX 27B (Perplexity Fine-Tune) Portable Computer 85,4 % 0,00 Euro (lokal)
Qwen 3.8 27B (Basismodell) Portable Computer 82,6 % 0,00 Euro (lokal)
Qwen 3.8 27B Pi Harness 77,6 % 0,00 Euro (lokal)
Qwen 3.8 27B Hermes Agent 74,0 % 0,00 Euro (lokal)

Um die Leistungsfähigkeit messbar zu machen, hat Perplexity den Local Knowledge Work Bench aufgesetzt wie das Unternehmen im Blogbeitrag ausführt. Der Test umfasst 53 praxisnahe Aufgaben aus den Bereichen Tiefenrecherche, Finanzanalysen und Dokumentenerstellung. Mit 85,4 Prozent übertraf das eigene System die Vergleichskombinationen deutlich. Perplexity kündigte an, den Test-Datensatz künftig als Open Source zu veröffentlichen.

Hybrid-Prinzip: Cloud-Eskalation nur auf Nutzerwunsch

Trotz des lokalen Schwerpunkts ist Portable Computer nicht komplett von der Außenwelt abgeschnitten. Das System bindet Konnektoren wie Google Drive, Gmail, Slack und GitHub ein. Stößt das lokale 27-Milliarden-Parameter-Modell bei hochkomplexen Fragestellungen an seine Grenzen oder ist eine Live-Recherche im Web erforderlich, schlägt der Agent eine Eskalation in die Cloud vor.

Dieser Schritt erfolgt nicht automatisch im Hintergrund: Der Nutzer muss die Weiterleitung an ein externes Spitzenmodell explizit per Klick freigeben. Vor der Übertragung filtert eine integrierte Schutzschicht personenbezogene Daten und sensible Merkmale (PII-Redaction) heraus, um den Datenschutz zu wahren.

Ökonomie der Agenten

Kostenvorteil für Firmen: Dauerhaft laufende Agentenschleifen in der Cloud können monatlich tausende Euro an API-Gebühren verschlingen. Lokale Inferenz verwandelt variable Betriebsausgaben in planbare Hardware-Investitionen.

Entlastung für Perplexity: Durch die Verlagerung der rechenintensiven Denkschleifen auf die Schreibtische der zahlenden Pro-, Max- und Enterprise-Kunden schont der Anbieter seine eigenen Rechenzentrumskapazitäten.

Mit der Veröffentlichung von Portable Computer setzt sich ein klarer Branchentrend fort: Nach der anfänglichen Euphorie über reine Cloud-Schnittstellen fordern vor allem europäische Unternehmen verlässliche Lösungen für Datensouveränität und Betriebsgeheimnisse. Ob kompakte 27B-Modelle auf Dauer mit den Fähigkeiten billionenschwerer Cloud-Giganten mithalten können, werden die Praxistests der kommenden Wochen zeigen.

🎯 Was das für die Praxis bedeutet

1. Lokale KI-Infrastruktur evaluieren: Entwicklerteams mit vertraulichem Code sollten Workstations mit mindestens 24 GB VRAM ausstatten, um Agenten ohne Datenschutzbedenken betreiben zu können.

2. Token-Kosten durch Hybrid-Strategie senken: Routineaufgaben und Datei-Iterationen auf lokaler Hardware abarbeiten und Cloud-Modelle nur noch als gezielte Eskalationsstufe für Spitzenleistungen zuschalten.

3. Klare Freigaberichtlinien für Cloud-Eskalation definieren: Unternehmen müssen Richtlinien etablieren, welche Mitarbeiter und Datenkategorien die integrierte Cloud-Erweiterung nutzen dürfen.

📰 Quellen
Perplexity Blog ↗ Perplexity Product ↗ VentureBeat ↗
Teilen: