Perplexity Hybrid Compute verdeelt een AI-taak tussen een frontiermodel in de cloud en een lokaal taalmodel dat op je eigen Mac draait. Het lokale model verwerkt gevoelige informatie, zodat die je computer nooit verlaat. Tegelijk druk je de kosten, want voor tokens die lokaal worden gegenereerd betaal je niets. De functie maakt deel uit van Personal Computer voor Mac en is beschikbaar voor abonnees op Pro en Max en voor zakelijke klanten van Perplexity.

Wat is Perplexity Hybrid Compute

Hybrid Compute is de nieuwste uitbreiding van Perplexity Computer, het agentplatform dat het bedrijf in februari 2026 lanceerde. Dat platform zet meerdere AI-agents tegelijk aan het werk met het web, je bestanden en apps op je computer. In april 2026 volgde Personal Computer voor de Mac, dat die mogelijkheden naar je lokale computer bracht. Hybrid Compute bepaalt per taak welk deel lokaal draait en welk deel naar de cloud gaat.

Een taak wordt opgesplitst in stukken. Delen met vertrouwelijke data blijven op je Mac. Delen die veel rekenkracht of diepere redenering vragen gaan naar een model als Opus 5 of GPT-5.6 Sol. Perplexity geeft het voorbeeld van een advocaat die een pleitnota voorbereidt waarin de eigen zaak wordt vergeleken met bestaande jurisprudentie. De cliëntgegevens blijven vertrouwelijk op de eigen machine, terwijl het cloudmodel de juridische vergelijking uitvoert.

Hoe de app bepaalt wat lokaal blijft

Zodra je bestanden uploadt of informatie verstuurt, controleert de Mac-app automatisch op gevoelige inhoud. Perplexity trainde daarvoor een eigen privacyclassifier die voorstelt welke bestanden en gegevens je beter op je computer houdt.

  • financiële gegevens en contracten
  • medische informatie
  • persoonlijke documenten en dossiers

Voordat Hybrid Compute het werk verdeelt, zie je een overzicht van de bestanden die het systeem wil afsluiten van de cloud. Je controleert of de selectie klopt en kiest zelf welke modellen het werk doen. “Elke keer dat je bestanden uploadt of informatie verstuurt, controleren we automatisch op gevoelige inhoud en vragen we of je die data naar de cloud wilt sturen”, zegt Jon Staff, die bij Perplexity alle Mac-producten aanstuurt.

De installatie van een lokaal model vraagt geen terminal of technische kennis. De app regelt het hele proces zelf.

Lokale modellen op eigen hardware

Voor het lokale model kies je uit Gemma E4B en twee varianten van Qwen 3.6 met 35 miljard parameters. Eén van die varianten trainde Perplexity zelf na. Het bedrijf zegt later meer lokale modellen toe te voegen.

Tijdens een taak toont een visualisatie het gebruik van je CPU, GPU en geheugen. Een zijbalk houdt bij hoeveel tokens de taak verbruikt. Tokens van het lokale model op je eigen machine zijn gratis. Na de eerste output geef je gewoon vervolginstructies zoals je gewend bent. Via een iPhone zet je taken op afstand klaar in de wachtrij.

Kwaliteit, privacy en kosten

Engadget vroeg Staff of Perplexity de output van Hybrid Compute heeft vergeleken met een volledig cloudgebaseerde aanpak. Zijn antwoord was eerlijk. Een volledig frontiermodel levert vrijwel altijd betere output. Dat model is duurder en capabeler. Maar veel gebruikers hebben dat maximale vermogen gewoon niet nodig voor hun werk. Voor hen zijn privacy en kostprijs belangrijker.

Staff beschrijft het als een knop waarbij de gebruiker zelf de positie bepaalt per type werk. Perplexity suggereert de beste optie op basis van de context, maar de uiteindelijke keuze ligt bij jou.

Die kostenkant is van belang voor agentisch werk. Een agent voert meerstapsplannen uit, roept tools aan, inspecteert documenten, probeert opnieuw en verifieert zichzelf. Als elke tussenstap naar een premium cloudmodel gaat, worden kosten moeilijk voorspelbaar. De routering reserveert dure inference voor de stappen die het echt nodig hebben.

Van demo op Computex naar de Mac-app

Perplexity toonde de techniek eerder dit jaar op Computex 2026 en presenteerde het als de eerste hybride orchestrator voor lokale en serverinference. Perplexity Computer coördineert in één workflow tot twintig AI-modellen tegelijk. De orchestrator breidt die coördinatie uit naar de fysieke plek waar elke stap draait. Het raamwerk is modelagnostisch en chipagnostisch. Op Computex draaide het op Intel Core Ultra Series 3 en op NVIDIA RTX Spark. Voor de consumentenversie koos Perplexity eerst voor de Mac. Een Windows-versie van Personal Computer staat gepland en je kan je inschrijven op de waiting list.

Routering wordt niet alleen gebruikt door Perplexity

Hybride inference groeit uit tot een vaste architectuurkeuze voor zakelijke AI. Agents werken inmiddels met bestandssystemen, spreadsheets, SharePoint, CRM en workflowtools. Zodra een agent met operationele data werkt, verschuift de vraag van welk model het slimst is naar waar elke stap draait, wie dat controleert en hoe je achteraf aantoont wat er gebeurde.

Volledig cloudgebaseerde agents starten snel, maar roepen vragen op over waar de data staat, wat met vertrouwelijke documenten, tokenkosten en snelheid. Volledig lokale systemen geven meer controle en worstelen met complex redeneren, modelupdates en beheer. Routering lost dit op. Gevoelige extractie en samenvatting gebeuren dicht bij de data. Minder confidentiële redeneerstappen en synthese gebruiken externe modellen wanneer die waarde toevoegen.

Routeringsbeleid, permissies, logging en fallbackgedrag ontwerpen is engineeringwerk. Wil je zelf met agents aan de slag, breng dan eerst in kaart welke data je omgeving mag verlaten, welke data niet en welke acties door wie moeten goedgekeurd worden.

Beschikbaarheid en systeemeisen

Hybrid Compute draait op Macs met Apple Silicon en macOS 15. Perplexity adviseert een machine met minstens 32 GB unified memory. Je hebt een abonnement op Pro of Max nodig, of een zakelijke enterpriseovereenkomst.

De plek waar je AI draait wordt een productkeuze

Waar een taak wordt uitgevoerd wordt in sommige gevallen even belangrijk als welk model je kiest. Naarmate kleinere modellen beter worden, groeit het lokale aandeel van vrijwel elke workflow. Wie die taakverdeling nu al serieus neemt, hoeft zijn architectuur later niet opnieuw te bouwen zodra de modelmarkt of de privacyregels veranderen.