로컬 우선 AI를 위한 Portable Computer 소개
Portable Computer는 NVIDIA와 함께 기기에서 Perplexity Computer를 완전히 실행하여 비공개 데이터를 로컬에 유지하고 작업에 필요할 때만 클라우드로 에스컬레이션합니다.

AI 에이전트에 대해 사람들이 처리하고자 하는 가장 가치 있는 작업 중 일부에는 자신의 기기에 보관하고 싶은 데이터가 포함됩니다. 비공개 코드베이스든 기밀 자료든, 로컬 모델은 이제 그들이 있는 곳 바로 그 자리에서 작업할 수 있을 만큼 강력해지고 있습니다.
오늘 우리는 로컬 기기에서 완전히 실행되는 Perplexity Computer의 버전인 Portable Computer를 출시합니다. 사용자가 NVIDIA의 데스크톱 크기 AI 컴퓨터인 NVIDIA DGX Spark™에서 스택을 소유할 수 있도록 NVIDIA와 함께 구축했습니다. 곧 NVIDIA RTX GPU PC에서도 사용할 수 있게 될 예정입니다.
Portable Computer를 사용하면 사용자가 Perplexity Computer를 기기에서 완전히 실행하여 데이터를 분석하고, 파일을 종합하며, 복잡한 워크플로우를 실행할 수 있습니다. 비공개 데이터는 로컬에 유지되며 기기 내 작업은 크레딧을 소모하지 않습니다. 사용자가 승인하면, 로컬 모델은 민감한 정보를 기기에 유지하면서 더 발전된 연구와 추론을 위해 클라우드로 에스컬레이션할 수 있습니다.
로컬 우선 AI 스택
Portable Computer는 사용자가 성능과 효율성의 균형을 맞추며 연산 장치를 최대한 활용하고자 할 때 출시됩니다. 사람들이 처음으로 자신의 컴퓨터에서 프론티어 수준의 강력한 성능을 사용할 수 있게 되면서, 더 이상 어떤 용도에 지능을 사용할지 배급제로 제한할 필요가 없어졌습니다.
Portable Computer는 Qwen 모델의 사후 학습 버전인 Qwen 3.8 27B 또는 PPLX 27B가 탑재된 NVIDIA DGX Spark에서 실행됩니다. 30B 오픈 모델인 NVIDIA Nemotron 3.5 Lightning도 곧 모델 선택 도구에 추가될 예정입니다. 오케스트레이터, 플래너, 도구 라우터, 스케줄러, 지속성 작업 큐 및 로컬 검색 색인은 모두 기기에서 실행됩니다.
Qwen 모델은 각 작업의 최대한 많은 부분을 로컬에서 완료하고, 필요할 때 클라우드로 에스컬레이션하도록 사후 학습되었습니다. 로컬 파일을 읽고, 문서와 코드를 검색하며, 기기에서 작업을 수행하고, 작업이 계속 실행되도록 유지합니다.
연산 장치를 직접 보유하면 로컬 모델이 처리하는 작업에 크레딧 비용이 발생하지 않기 때문에 대규모 AI 작업을 실용적으로 실행할 수 있습니다.
클라우드로 에스컬레이션
Portable Computer는 누구나 실행해야 하는 대부분의 작업을 완전히 로컬에서 처리합니다. 하지만 일부 작업은 웹이나 클라우드의 프론티어 추론 기능에 액세스하는 것이 유리합니다. 사용자는 텀 시트의 기밀 세부 정보는 로컬에 유지하고 싶어 하면서도 최신 시장 비교 데이터나 최근 선례 거래를 확인하기 위해 클라우드로 에스컬레이션할 수 있습니다.
Portable Computer의 로컬 오케스트레이터는 최신 정보, 브라우저 사용, 연결된 앱 또는 고급 추론을 위한 15개 이상의 프론티어 모델 중 하나를 위해 작업을 클라우드로 에스컬레이션할 수 있습니다.
앱 커넥터를 통해 Portable Computer는 Google Drive, Gmail, Slack 및 GitHub과 연동됩니다. 사용자는 아침이 되기 전에 기기에서 Gmail의 전날 밤 버그 보고서와 비교하여 새로운 GitHub 이슈를 트리아지한 후, 추천 담당자와 함께 상위 3개 이슈에 대한 Slack 메시지를 보낼 수 있습니다.
작업이 기기의 콘텐츠를 클라우드 서비스로 전송해야 하는 경우, Portable Computer는 진행하기 전에 사용자에게 권한을 요청합니다.
검색 및 받아쓰기
로컬 모델은 기기에 있는 내용만 알고 있습니다. 외부 세계가 필요한 작업의 경우, Portable Computer는 Perplexity 검색 또는 광범위하거나 심층적인 리서치를 실행할 수도 있습니다. 사용자는 다른 모든 작업의 로컬 실행을 포기하지 않고도 웹에서 인용된 검색 결과를 얻을 수 있습니다.
받아쓰기 모드 역시 NVIDIA Nemotron 3.5 ASR 모델을 통해 로컬에서 실행됩니다. 사용자는 문서를 읽거나 종이에 스케치하면서 에이전트에게 브리핑을 합니다. 파일에 대한 전사 및 작업은 모두 기기에 유지됩니다. 사용자는 오디오가 클라우드에 닿지 않게 하면서 클라이언트 상황을 이야기하거나 비공개 코드베이스에 대해 받아쓰기를 할 수 있습니다.
보안은 Perplexity Computer의 클라우드 버전과 동일합니다. 코드 및 도구 실행은 파일 및 연결된 앱에 대한 제어된 액세스가 가능한 격리된 샌드박스 환경에서 실행됩니다.
오늘은 로컬 AI의 시작에 불과합니다.
모델이 강력해지고 칩이 빨라짐에 따라 더 많은 사람들이 자신의 기기에서 복잡한 워크플로우를 실행하게 될 것입니다. 모든 칩 주기와 모델 출시가 이를 더욱 가속화합니다. 개인 기기에서 AI를 실행하는 것은 업무가 처리되는 방식에서 훨씬 더 큰 비중을 차지하게 될 것입니다.
Portable Computer는 NVIDIA DGX Spark를 사용하는 Pro 및 Max 구독자가 이용할 수 있습니다. 첫 번째 릴리스는 Linux에서 지원되며, Windows 지원도 곧 제공될 예정입니다.
NVIDIA DGX Spark는 20코어 Arm CPU와 128GB 통합 메모리를 갖춘 NVIDIA GPU인 Grace Blackwell GB10 플랫폼을 기반으로 제작되었습니다. Portable Computer는 Perplexity 앱을 통해 원클릭 설정으로 설치할 수 있습니다.
NVIDIA 로컬 AI 블로그에서 출시 관련 소식을 자세히 알아보세요. 당사의 연구 블로그인 A Local-First Agent for Private and Cost-Effective Knowledge Work에서는 Portable Computer의 개발 배경과 정확도, 속도, 크레딧 효율성 측면의 벤치마크 뛰어넘는 성능에 대해 자세히 설명합니다.
지금 Portable Computer를 사용해 보세요.