Protegendo a IA com a Perplexity
O CISO da Perplexity, Kyle Polley, e o Gerente de Sucesso do Cliente, Scott Lerner, abordam os princípios por trás da abordagem de segurança em primeiro lugar da Perplexity.

Kyle Polley
CISO, Perplexity AI

Scott Lerner
Customer Success Manager
Recursos de segurança referenciados nesta sessão
- Como criamos segurança no Computer
- Sandboxes seguros para agentes
- Mitigação de injeção de prompt no Comet
- Artigo de pesquisa do BrowseSafe
- Protegendo agentes com Numbat
- Tornando o Bumblebee de código aberto
- Secure Intelligence Institute
- Central de Confiabilidade
Perguntas frequentes
Construindo segurança em toda a pilha de IA
Como a Perplexity aborda a segurança ao construir em tantas camadas da pilha de IA? Tudo o que a Perplexity cria começa com um raciocínio voltado para a segurança, e tratamos segurança e proteção como funções relacionadas, mas distintas. A proteção trata de proteger humanos contra agentes. A segurança trata de proteger agentes contra humanos. Construir em toda a pilha significa que podemos colocar os controlos certos na camada certa para as tarefas certas, em vez de adicionar proteção a uma caixa preta que não possuímos.
SPACE, o sandbox de agentes da Perplexity
O que é um sandbox e como ele protege utilizadores e agentes? Um sandbox dá ao código um lugar contido para ser executado sem alcançar os seus sistemas ou dados. Os agentes aumentam os riscos, por isso, no Computer, cada tarefa obtém o seu próprio sandbox.
Por que a Perplexity construiu o seu próprio sandbox (SPACE) em vez de usar um existente? As ferramentas prontas para uso não podiam fornecer a segurança que a Perplexity deseja garantir aos nossos clientes. Os agentes quebram a suposição de que os sandboxes servem para a execução de código de curta duração. Isso introduz duas necessidades que se opõem: o ambiente deve ser descartável, mas o trabalho deve ser persistente. As plataformas existentes faziam escolher dois entre três aspetos: funcionalidade, eficiência e segurança. O SPACE foi construído para entregar todos os três.
Como o SPACE realmente funciona e quais controlos de segurança ele possui? O SPACE torna a sessão o objeto durável em vez do sandbox. Uma sessão é uma cadeia de capturas de ecrã dinâmicas, e essas capturas de ecrã ativam o conjunto completo de controlos do SPACE. Pausar é apenas parar o sandbox. Retomar é restaurar a captura de ecrã mais recente em qualquer máquina. Bifurcar é restaurar a mesma captura de ecrã duas vezes e permitir que as cópias divergem. Os utilizadores obtêm continuidade, juntamente com um botão de máquina do tempo se algo correr mal.
Onde ficam as minhas credenciais quando um agente age em meu nome? Os sandboxes são onde o trabalho não confiável acontece, por isso é o último lugar onde as chaves devem ficar. Se um agente fosse sequestrado, o atacante herdaria tudo o que o agente possui, e é por isso que os nossos agentes não possuem nada. As credenciais chegam de fora da caixa, no momento exato em que são necessárias, apenas para essa tarefa.
RBAC, conectores e recursos de segurança da Perplexity
A que a Perplexity realmente obtém acesso quando um conector como Snowflake ou Outlook é conectado, e o que um administrador pode desativar? Ao contrário das ferramentas de agente que começam com acesso a todo o seu computador, o Computer começa sem acesso. O acesso vem através do OAuth com permissões exatas, portanto, se não consegue ver, o seu agente não consegue ver. Os administradores podem desativar um conector inteiro ou apenas ferramentas específicas dentro de um.
Como o RBAC da Perplexity se integra com o nosso fornecedor de identidade?
O fornecedor de identidade de uma organização já responde quem pode tocar no quê. A Perplexity conecta-se a ele e esses limites passam diretamente para o produto. A sua fonte de verdade permanece a fonte de verdade e o seu registo de auditoria permanece preciso. As equipas obtêm o contexto de que precisam e as empresas mantêm o controlo sobre quem vê o quê.
Como a Perplexity protege os agentes contra a injeção de prompt na web aberta? A injeção de prompt é engenharia social, direcionada a agentes em vez de funcionários, e a web aberta é onde estranhos podem falar com ele. O BrowseSafe trata cada página que o agente lê como não confiável e examina-a em paralelo, antes que o conteúdo possa moldar o que o agente faz. A pesquisa de segurança mantida apenas para si protege apenas a si. Os agentes de todos leem a mesma web, então tornamos o benchmark público.
Quais ferramentas a Perplexity usa para proteger as máquinas em que os agentes e funcionários executam? O Bumblebee responde à primeira pergunta após cada incidente de cadeia de suprimentos: o pacote defeituoso está em algum lugar nos nossos sistemas? O Numbat observa a camada do agente por si mesma e lê o comportamento em sequência. Como ele fica onde o agente age, ele pode parar uma ação antes que ela seja executada.
Usando o Computer para proteger o Computer
O Computer pode ser confiável com trabalho real de segurança? A própria equipa de segurança da Perplexity construiu a sua infraestrutura de segurança internamente em cima do Computer, em vez de esperar que as ferramentas externas alcancem o mesmo nível. A execução agnóstica de modelos, a memória persistente e o resto do roteiro já estavam lá, para que a equipa pudesse se concentrar no próprio agente de segurança. Construir o melhor agente de segurança significa precisar do melhor arnês por baixo dele.
Onde o Computer remove o trabalho mais repetitivo da placa de uma equipa de segurança? O Computer pode ajudar na triagem de alertas perdidos e relatórios de incidentes de acompanhamento. Cada triagem no Computer retorna documentada por padrão, para que os analistas comecem a partir de uma investigação escrita em vez de um alerta bruto.

