Protegendo a IA com a Perplexity
O CISO da Perplexity, Kyle Polley, e o gerente de Sucesso do Cliente, Scott Lerner, abordam os princípios por trás da abordagem de segurança em primeiro lugar da Perplexity.

Kyle Polley
CISO, Perplexity AI

Scott Lerner
Customer Success Manager
Recursos de segurança mencionados nesta sessão
- Como incorporamos a segurança ao Computer
- Sandboxes seguras para agentes
- Mitigando a injeção de prompt no Comet
- Artigo de pesquisa BrowseSafe
- Protegendo agentes com o Numbat
- Tornando o Bumblebee de código aberto
- Secure Intelligence Institute
- Central de Confiabilidade
Perguntas frequentes
Construindo segurança em toda a pilha de IA
Como a Perplexity aborda a segurança ao desenvolver em tantas camadas da pilha de IA? Tudo o que a Perplexity desenvolve começa com uma mentalidade voltada para a segurança, e tratamos a proteção e a segurança como funções relacionadas, mas distintas. A proteção refere-se a blindar os seres humanos contra os agentes. A segurança refere-se a blindar os agentes contra os seres humanos. Desenvolver em toda a pilha significa que podemos colocar os controles certos na camada certa para as tarefas certas, em vez de anexar proteção a uma caixa-preta que não controlamos.
SPACE, o sandbox de agentes da Perplexity
O que é um sandbox e como ele protege os usuários e os agentes? Um sandbox oferece ao código um local contido para ser executado sem alcançar seus sistemas ou dados. Os agentes aumentam os riscos, portanto, no Computer, cada tarefa recebe seu próprio sandbox.
Por que a Perplexity construiu seu próprio sandbox (SPACE) em vez de usar um existente? As ferramentas prontas para uso não podiam fornecer a segurança que a Perplexity deseja garantir aos nossos clientes. Os agentes quebram a premissa de que os sandboxes servem para a execução de código de curta duração. Isso introduz duas necessidades que competem entre si: o ambiente deve ser descartável, mas o trabalho deve ser persistente. As plataformas existentes exigiam que você escolhesse duas entre três opções: funcionalidade, eficiência e segurança. O SPACE foi criado para entregar as três.
Como o SPACE funciona na prática e quais controles de segurança ele possui? O SPACE torna a sessão o objeto durável em vez do sandbox. Uma sessão é uma cadeia de capturas de tela contínuas, e essas capturas de tela habilitam o conjunto completo de controles do SPACE. Pausar significa apenas interromper o sandbox. Retomar significa restaurar a captura de tela mais recente em qualquer máquina. Bifurcar (fork) significa restaurar a mesma captura de tela duas vezes e permitir que as cópias divergam. Os usuários obtêm continuidade, além de um botão de máquina do tempo caso algo dê errado.
Onde ficam minhas credenciais quando um agente age em meu nome? Os sandboxes são onde ocorre o trabalho não confiável, portanto, esse é o último lugar onde as chaves devem residir. Se um agente fosse sequestrado, o invasor herdaria tudo o que o agente possui, e é por isso que nossos agentes não possuem nada. As credenciais chegam de fora da caixa, no momento exato em que são necessárias, apenas para essa tarefa.
RBAC, conectores e os recursos de segurança da Perplexity
A o que a Perplexity realmente tem acesso quando um conector como o Snowflake ou o Outlook é conectado, e o que um administrador pode desativar? Ao contrário das ferramentas de agente que começam com acesso a todo o seu computador, o Computer começa sem acesso. O acesso ocorre por meio de OAuth com permissões exatas, portanto, se você não consegue ver, seu agente não consegue ver. Os administradores podem desativar um conector inteiro ou apenas ferramentas específicas dentro dele.
Como o RBAC da Perplexity se integra ao nosso provedor de identidade?
O provedor de identidade de uma organização já responde quem pode acessar o quê. A Perplexity se conecta a ele e esses limites são transferidos diretamente para o produto. Sua fonte de verdade continua sendo a fonte de verdade, e sua trilha de auditoria permanece precisa. As equipes obtêm o contexto de que precisam e as empresas mantêm o controle sobre quem vê o quê.
Como a Perplexity protege os agentes contra a injeção de prompt na web aberta? A injeção de prompt é engenharia social voltada para agentes em vez de funcionários, e a web aberta é onde estranhos podem interagir com ele. O BrowseSafe trata cada página lida pelo agente como não confiável e a examina em paralelo, antes que o conteúdo possa moldar o comportamento do agente. A pesquisa de segurança mantida apenas para você protege apenas você. Os agentes de todos leem a mesma web, por isso tornamos o benchmark público.
Quais ferramentas a Perplexity usa para proteger as máquinas em que os agentes e funcionários executam? O Bumblebee responde à primeira pergunta após cada incidente na cadeia de suprimentos: o pacote malicioso está presente em nossos sistemas? O Numbat monitora a camada do agente e lê o comportamento em sequência. Por estar posicionado onde o agente atua, ele pode interromper uma ação antes de sua execução.
Usando o Computer para proteger o Computer
É possível confiar no Computer para trabalhos de segurança reais? A própria equipe de segurança da Perplexity construiu sua infraestrutura de segurança internamente sobre o Computer, em vez de aguardar que ferramentas externas o alcançassem. A execução agnóstica de modelos, a memória persistente e o restante do roteiro já estavam presentes, permitindo que a equipe focasse no próprio agente de segurança. Construir o melhor agente de segurança requer dispor da melhor estrutura subjacente.
Em que áreas o Computer retira o trabalho mais repetitivo da rotina de uma equipe de segurança? O Computer pode auxiliar na triagem de alertas perdidos e em relatórios de incidentes de acompanhamento. Toda triagem no Computer retorna documentada por padrão, permitindo que os analistas iniciem a partir de uma investigação escrita em vez de um alerta bruto.

