KI absichern mit Perplexity

Perplexitys CISO Kyle Polley und Customer Success Manager Scott Lerner erläutern die Prinzipien hinter dem sicherheitsorientierten Ansatz von Perplexity.

  • Kyle Polley

    CISO, Perplexity AI

  • Scott Lerner

    Customer Success Manager

Sicherheitsressourcen, auf die in dieser Sitzung verwiesen wird

Häufig gestellte Fragen

Aufbau von Sicherheit im gesamten KI-Stack

Wie geht Perplexity beim Aufbau über so viele Schichten des KI-Stacks hinweg mit dem Thema Sicherheit um? Alles, was Perplexity entwickelt, beginnt mit einem sicherheitsorientierten Denken. Wir behandeln Sicherheit (Safety) und Absicherung (Security) als verwandte, aber unterschiedliche Aufgaben. Bei Safety geht es darum, Menschen vor Agenten zu schützen. Bei Security geht es darum, Agenten vor Menschen zu schützen. Das Bauen über den gesamten Stack hinweg bedeutet, dass wir die richtigen Kontrollmechanismen für die richtigen Aufgaben in der richtigen Schicht platzieren können, anstatt Schutzmaßnahmen auf eine Blackbox zu setzen, die uns nicht gehört.

SPACE, die Agenten-Sandbox von Perplexity

Was ist eine Sandbox und wie schützt sie Benutzer und Agenten? Eine Sandbox gibt Code einen eingegrenzten Bereich zum Ausführen, ohne dass dieser Ihre Systeme oder Daten erreicht. Agenten erhöhen den Einsatz, weshalb in Computer jede Aufgabe eine eigene Sandbox erhält.

Warum hat Perplexity eine eigene Sandbox (SPACE) entwickelt, anstatt eine bestehende zu nutzen? Vorgefertigte Tools konnten nicht die Sicherheit bieten, die Perplexity unseren Kunden garantieren möchte. Agenten durchbrechen die Annahme, dass Sandboxes für kurzlebige Code-Ausführungen gedacht sind. Das führt zu zwei Anforderungen, die im Widerspruch zueinander stehen: Die Umgebung soll wegwerfbar sein, aber die Arbeit soll persistent bleiben. Bisherige Plattformen zwangen dazu, zwei von drei Eigenschaften aus Funktionalität, Effizienz und Sicherheit auszuwählen. SPACE wurde entwickelt, um alle drei zu erfüllen.

Wie funktioniert SPACE konkret und über welche Sicherheitskontrollen verfügt es? SPACE macht die Sitzung anstelle der Sandbox zum persistenten Objekt. Eine Sitzung ist eine Kette von fortlaufenden Snapshots, und diese Snapshots ermöglichen den vollständigen Steuerungsumfang von SPACE. Das Pausieren ist einfach das Anhalten der Sandbox. Das Fortsetzen ist das Wiederherstellen des neuesten Snapshots auf einem beliebigen Computer. Das Forking ist das zweimalige Wiederherstellen desselben Snapshots und das Zulassen, dass die Kopien divergieren. Benutzer erhalten Kontinuität sowie eine Zeitmaschinen-Schaltfläche, falls etwas schiefgeht.

Wo befinden sich meine Anmeldedaten, wenn ein Agent in meinem Namen handelt? Sandboxes sind der Ort, an dem nicht vertrauenswürdige Arbeit stattfindet, daher ist dies der letzte Ort, an dem Schlüssel liegen sollten. Wenn ein Agent kompromittiert würde, würde der Angreifer alles erben, was der Agent hält, weshalb unsere Agenten nichts halten. Anmeldedaten kommen von außerhalb der Box, genau in dem Moment, in dem sie benötigt werden, und nur für diese Aufgabe.

RBAC, Konnektoren und die Sicherheitsfunktionen von Perplexity

Worauf erhält Perplexity tatsächlich Zugriff, wenn ein Konnektor wie Snowflake oder Outlook verbunden wird, und was kann ein Administrator deaktivieren? Im Gegensatz zu Agenten-Tools, die mit Zugriff auf Ihren gesamten Computer beginnen, startet Computer ohne Zugriff. Der Zugriff erfolgt über OAuth mit genauen Berechtigungen. Wenn Sie es also nicht sehen können, kann Ihr Agent es auch nicht sehen. Administratoren können einen gesamten Konnektor oder nur bestimmte Tools darin deaktivieren.

Wie lässt sich das RBAC von Perplexity in unseren Identitätsanbieter integrieren?

Der Identitätsanbieter einer Organisation beantwortet bereits, wer auf was zugreifen darf. Perplexity bindet sich darin ein, und diese Grenzen übertragen sich direkt auf das Produkt. Ihre maßgebliche Datenquelle bleibt die maßgebliche Datenquelle, und Ihr Audit-Trail bleibt präzise. Teams erhalten den Kontext, den sie benötigen, und Unternehmen behalten die Kontrolle darüber, wer was sieht.

Wie schützt Perplexity Agenten vor Prompt-Injektionen im offenen Web? Prompt-Injektion ist Social Engineering, das auf Agenten statt auf Mitarbeiter abzielt, und das offene Web ist der Ort, an dem Fremde mit ihm sprechen können. BrowseSafe behandelt jede Seite, die der Agent liest, als nicht vertrauenswürdig und scannt sie parallel, bevor der Inhalt das Verhalten des Agenten beeinflussen kann. Sicherheitsforschung für sich zu behalten schützt nur Sie selbst. Die Agenten aller lesen dasselbe Web, deshalb haben wir den Benchmark öffentlich gemacht.

Welche Tools verwendet Perplexity, um die Maschinen zu schützen, auf denen Agenten und Mitarbeiter arbeiten? Bumblebee beantwortet nach jedem Lieferkettenvorfall die erste Frage: Befindet sich das schädliche Paket irgendwo auf unseren Systemen? Numbat überwacht die Agentenschicht selbst und liest das Verhalten in der Sequenz. Da es dort sitzt, wo der Agent agiert, kann es eine Aktion stoppen, bevor sie ausgeführt wird.

Computer zur Absicherung von Computer nutzen

Kann Computer bei echten Sicherheitsaufgaben vertraut werden? Das eigene Sicherheitsteam von Perplexity hat seine Sicherheitsinfrastruktur intern auf Computer aufgebaut, anstatt darauf zu warten, dass externe Tools aufholen. Modellagnostische Ausführung, persistenter Speicher und der Rest der Roadmap waren bereits vorhanden, sodass sich das Team auf den Sicherheitsagenten selbst konzentrieren konnte. Um den besten Sicherheitsagenten zu entwickeln, ist das beste zugrundeliegende Framework erforderlich.

Wo nimmt Computer einem Sicherheitsteam die repetitivste Arbeit ab? Computer kann bei der Triage verpasster Warnungen und Folge-Vorfallberichten helfen. Jede Triage in Computer wird standardmäßig dokumentiert zurückgegeben, sodass Analysten von einer schriftlichen Untersuchung anstelle einer rohen Warnung ausgehen.

Weitere Workshops entdecken

Bereit für den nächsten Schritt?

Entdecken Sie, wie Perplexity Ihre Arbeitsweise verändern kann