Perplexity와 함께하는 AI 보안

Perplexity의 CISO Kyle Polley와 고객 성공 관리자 Scott Lerner가 Perplexity의 보안 우선 접근 방식 이면의 원칙을 다룹니다.

  • Kyle Polley

    CISO, Perplexity AI

  • Scott Lerner

    Customer Success Manager

이 세션에서 참조된 보안 리소스

자주 묻는 질문

AI 스택 전반에 걸친 보안 구축

Perplexity는 매우 다양한 AI 스택 레이어에 걸쳐 구축할 때 보안에 어떻게 접근하나요? Perplexity가 구축하는 모든 것은 보안 우선 사고방식에서 시작되며, 안전(safety)과 보안(security)을 관련되어 있지만 별개의 업무로 취급합니다. 안전은 인간을 에이전트로부터 보호하는 것입니다. 보안은 에이전트를 인간으로부터 보호하는 것입니다. 스택 전체에 걸친 구축은 우리가 소유하지 않은 블랙박스에 보호 기능을 덧붙이는 것이 아니라, 적절한 작업에 적절한 레이어의 적절한 제어 기능을 배치할 수 있음을 의미합니다.

SPACE, Perplexity의 에이전트 샌드박스

샌드박스란 무엇이며, 사용자 and 에이전트를 어떻게 보호하나요? 샌드박스는 시스템이나 데이터에 접근하지 않고 코드가 실행될 수 있는 격리된 공간을 제공합니다. 에이전트로 인해 중요도가 높아졌으므로, Computer에서는 모든 작업이 고유한 샌드박스를 갖습니다.

Perplexity는 기존 샌드박스 대신 자체 샌드박스(SPACE)를 구축한 이유는 무엇인가요? 기성 도구는 고객에게 보장하고자 하는 보안을 Perplexity에 제공할 수 없었습니다. 에이전트는 샌드박스가 단기 코드 실행용이라는 가정의 허점을 드러냅니다. 이로 인해 환경은 일회성여야 하지만 작업은 지속되어야 한다는 상충되는 두 가지 요구가 발생합니다. 기존 플랫폼에서는 기능, 효율성, 보안 중 세 가지 중 두 가지를 선택해야 했습니다. SPACE는 이 세 가지 모두를 제공하도록 구축되었습니다.

SPACE는 실제로 어떻게 작동하며, 어떤 보안 제어 기능을 갖추고 있나요? SPACE는 샌드박스 대신 세션을 지속적인 객체로 만듭니다. 세션은 롤링 스냅샷의 체인이며, 이러한 스냅샷은 SPACE의 전체 제어 세트를 활성화합니다. 일시 중지는 단순히 샌드박스를 중지하는 것입니다. 재개는 모든 머신에서 최신 스냅샷을 복원하는 것입니다. 포크는 동일한 스냅샷을 두 번 복원하고 복사본이 서로 다른 방향으로 분기되도록 하는 것입니다. 사용자는 문제 발생 시 타임머신 버튼과 함께 연속성을 확보할 수 있습니다.

에이전트가 나를 대신해 행동할 때 내 자격 증명은 어디에 저장되나요? 샌드박스는 신뢰할 수 없는 작업이 수행되는 곳이므로 키가 보관되어야 할 가장 마지막 장소입니다. 에이전트가 탈취당하면 공격자는 에이전트가 보유한 모든 것을 상속받게 되므로, 당사의 에이전트는 아무것도 보유하지 않습니다. 자격 증명은 상자 외부에서, 정확히 필요한 순간에, 해당 작업만을 위해 도착합니다.

RBAC, 커넥터 및 Perplexity의 보안 기능

Snowflake나 Outlook과 같은 커넥터가 연결될 때 Perplexity는 실제로 무엇에 대한 접근 권한을 얻으며, 관리자는 무엇을 끌 수 있나요? 전체 컴퓨터에 대한 접근 권한으로 시작하는 에이전트 도구와 달리, Computer는 접근 권한이 없는 상태로 시작합니다. 접근 권한은 정확한 권한을 가진 OAuth를 통해 제공되므로 사용자가 볼 수 없는 것은 에이전트도 볼 수 없습니다. 관리자는 전체 커넥터를 끄거나 내부의 특정 도구만 끌 수 있습니다.

Perplexity의 RBAC는 당사의 ID 공급자와 어떻게 통합되나요?

조직의 ID 공급자는 이미 누가 무엇에 접근할 수 있는지에 대한 답변을 제공합니다. Perplexity는 이에 연결되며 해당 경계가 제품에 그대로 적용됩니다. 진실의 원천(source of truth)은 그대로 유지되며 감사 추적도 정확하게 유지됩니다. 팀은 필요한 컨텍스트를 얻고, 회사는 누가 무엇을 보는지에 대한 제어권을 유지합니다.

Perplexity는 오픈 웹상의 프롬프트 인젝션으로부터 에이전트를 어떻게 보호하나요? 프롬프트 인젝션은 직원이 아닌 에이전트를 겨냥한 사회공학적 공격이며, 오픈 웹은 낯선 이들이 에이전트와 대화하는 곳입니다. BrowseSafe는 에이전트가 읽는 모든 페이지를 신뢰할 수 없는 것으로 취급하고, 콘텐츠가 에이전트의 동작을 형성하기 전에 병렬로 스캔합니다. 혼자만 아는 보안 연구는 자신만을 보호할 뿐입니다. 모든 사람의 에이전트가 동일한 웹을 읽으므로 벤치마크를 공개했습니다.

Perplexity는 에이전트와 직원이 실행하는 머신을 보호하기 위해 어떤 도구를 사용하나요? Bumblebee는 모든 공급망 인시던트 이후의 첫 번째 질문에 답합니다. 취약한 패키지가 당사 시스템 어디에든 있는가? Numbat은 에이전트 계층 자체를 모니터링하고 순서에 따라 동작을 읽습니다. 에이전트가 작동하는 위치에 있기 때문에 실행되기 전에 작업을 중지할 수 있습니다.

Computer를 사용하여 Computer 보호하기

Computer가 실제 보안 작업을 수행하도록 신뢰할 수 있나요? Perplexity의 자체 보안 팀은 외부 도구가 따라잡기를 기다리는 대신 Computer 위에 자체 보안 인프라를 사내에서 구축했습니다. 모델에 구애받지 않는 실행, 지속적인 메모리 및 나머지 로드맵이 이미 마련되어 있어 팀은 보안 에이전트 자체에 집중할 수 있었습니다. 최고의 보안 에이전트를 구축한다는 것은 그 아래에 최고의 하네스가 필요하다는 것을 의미합니다.

Computer가 보안 팀의 업무 부담 중 가장 반복적인 작업을 덜어주는 곳은 어디인가요? Computer는 누락된 알림 분류 및 후속 인시던트 보고서를 지원할 수 있습니다. Computer의 모든 분류는 기본적으로 문서화되어 반환되므로 분석가는 원시 알림 대신 서면 조사부터 시작할 수 있습니다.

워크숍 더 살펴보기

다음 단계로 나아갈 준비가 되셨나요?

Perplexity가 당신의 업무 방식을 어떻게 바꿀 수 있는지 알아보세요