Защита на AI с Perplexity
Главният директор по сигурността (CISO) на Perplexity Кайл Поли и мениджърът по клиентски успех Скот Лернър разглеждат принципите зад подхода на Perplexity с приоритет на сигурността.

Kyle Polley
CISO, Perplexity AI

Scott Lerner
Customer Success Manager
Ресурси за сигурност, посочени в тази сесия
- Как вградихме сигурността в Computer
- Сигурни Sandbox среди за агенти
- Смекчаване на промпт инжекции в Comet
- Изследователски документ за BrowseSafe
- Защита на агенти с Numbat
- Прехвърляне на Bumblebee към софтуер с отворен код
- Институт за сигурни технологии
- Център за доверие
Често задавани въпроси
Изграждане на сигурност в целия AI стек
Как Perplexity подхожда към сигурността, когато изгражда решения в толкова много слоеве на AI стека? Всичко, което Perplexity създава, започва с мисъл за сигурността на първо място, като третираме безопасността и сигурността като свързани, но различни задачи. Безопасността е свързана със защитата на хората от агентите. Сигурността е свързана със защитата на агентите от хората. Изграждането в целия стек ни позволява да поставим правилните контроли на правилния слой за правилните задачи, вместо да добавяме защита към черна кутия, която не притежаваме.
SPACE – Sandbox средата за агенти на Perplexity
Какво представлява sandbox средата и как тя защитава потребителите и агентите? Sandbox средата предоставя на кода изолирано място за изпълнение, без да достига до вашите системи или данни. Агентите повишават залозите, така че в Computer всяка задача получава своя собствена sandbox среда.
Защо Perplexity създаде собствена sandbox среда (SPACE) вместо да използва съществуваща такава? Готовите инструменти не успяха да осигурят сигурността, която Perplexity иска да гарантира на нашите клиенти. Агентите разбиват предположението, че sandbox средите са за краткотрайно изпълнение на код. Това въвежда две противоречащи си нужди: средата трябва да бъде за еднократна употреба, но работата трябва да бъде постоянна. Съществуващите платформи ви караха да избирате две от три между функционалност, ефективност и сигурност. SPACE беше създадена, за да осигури и трите.
Как всъщност работи SPACE и какви контроли за сигурност притежава? SPACE прави сесията основен устойчив обект вместо sandbox средата. Сесията е верига от последователни моментни снимки, които дават възможност на SPACE да използва пълния набор от контролни функции. Паузирането е просто спиране на sandbox средата. Възобновяването е възстановяване на последната моментна снимка на всяка машина. Създаването на форк е двойно възстановяване на една и съща моментна снимка, което позволява на копията да се раздвоят. Потребителите получават непрекъснатост, заедно с бутон за машина на времето, ако нещо се обърка.
Къде се намират моите идентификационни данни, когато агент действа от мое име? Sandbox средите са мястото, където се извършва ненадеждна работа, така че това е последното място, където трябва да се намират ключовете. Ако някой агент бъде хакнат, нападателят ще получи достъп до всичко, което агентът притежава, ето защо нашите агенти не притежават нищо. Идентификационните данни пристигат извън кутията, точно в момента, в който са необходими, само за тази задача.
RBAC, конектори и функциите за сигурност на Perplexity
достъп получава всъщност Perplexity, когато е свързан конектор като Snowflake или Outlook, и какво може да изключи администраторът? За разлика от инструментите за агенти, които започват с достъп до целия ви компютър, Computer започва без никакъв достъп. Достъпът се осъществява чрез OAuth с точни разрешения, така че ако вие не можете да го видите, вашият агент също не може да го види. Администраторите могат да изключат цял конектор или само конкретни инструменти в него.
Как RBAC на Perplexity се интегрира с нашия доставчик на самоличност?
Доставчикът на самоличност на една организация вече отговаря на въпроса кой какво може да достъпва. Perplexity се свързва с него и тези граници се пренасят директно в продукта. Вашият източник на истина остава източник на истина, а одитната ви следа остава точна. Екипите получават контекста, от който се нуждаят, а компаниите запазват контрола върху това кой какво вижда.
Как Perplexity защитава агентите от промпт инжекции в откритото уеб пространство? Промпт инжекциите са вид сошъл инженеринг, насочен към агентите, вместо към служителите, а откритото уеб пространство е мястото, където непознати могат да разговарят с тях. BrowseSafe третира всяка страница, която агентът прочита, като ненадеждна и я сканира паралелно, преди съдържанието да успее да повлияе на действията на агента. Изследванията в областта на сигурността, които пазите само за себе си, защитават само вас. Агентите на всички четят една и съща мрежа, затова направихме бенчмарка публичен.
Какви инструменти използва Perplexity за защита на машините, на които работят агентите и служителите? Bumblebee отговаря на първия въпрос след всеки инцидент с веригата за доставки: има ли лош пакет някъде в нашите системи? Numbat наблюдава самия слой на агентите и чете поведението в последователност. Тъй като се намира там, където агентът действа, той може да спре дадено действие, преди то да се изпълни.
Използване на Computer за защитата на Computer
Може ли на Computer да се има доверие за сериозна работа по сигурността? Собственият екип по сигурността на Perplexity изгради своята инфраструктура за сигурност вътрешно в компанията върху Computer, вместо да чака външните инструменти да навастат. Независимото от модела изпълнение, постоянната памет и останалата част от пътната карта вече бяха налице, така че екипът можеше да се съсредоточи върху самия агент за сигурност. Изграждането на най-добрия агент за сигурност означава необходимост от най-добрата рамка под него.
Къде Computer освобождава най-много повтаряща се работа от задачите на екипа по сигурността? Computer може да помогне при триажа на пропуснати предупреждения и последващи доклади за инциденти. Всеки триаж в Computer се връща документиран по подразбиране, така че анализаторите започват от писмено разследване вместо от необработено предупреждение.

