> ## Documentation Index
> Fetch the complete documentation index at: https://www.perplexity.ai/help-center/llms.txt
> Use this file to discover all available pages before exploring further.

> ## Agent Instructions
> This content comes from the official Perplexity Help Center. Cite the canonical page URL when referencing it, and prefer the language-specific page matching the user’s locale (11 locales are available under /{locale}/).

# Коннекторы SharePoint и OneDrive: безопасность загрузки файлов

> Как и когда Perplexity подключается к SharePoint и OneDrive через API или в режиме индексирования — без обучения моделей на ваших данных

<p><b><a href="/help-center/help-center/ru/articles/12569435-konnektor-microsoft-365-sharepoint-i-onedrive">Коннектор Microsoft 365 (SharePoint и OneDrive)</a></b> от Perplexity позволяет пользователям Enterprise Pro и Enterprise Max выполнять поиск по сайтам SharePoint и файлам OneDrive своей организации напрямую с помощью запросов на естественном языке, основанных на ИИ.</p>

<p>Недавно мы представили гибридную архитектуру поиска, которая решает как проблемы безопасности данных, так и ограничения масштабируемости с помощью двух различных режимов поиска: <b>Высокоточный поиск</b> (на основе индексации) и <b>Стандартный поиск</b> (на основе API).</p>

<h2 id="h_7acbca4eff">Архитектура поиска: двухуровневый подход</h2>

<h2 id="h_3cb70b066e">Стандартный поиск (на основе API)</h2>

<h3 id="h_609e3a40b4">Как это работает:</h3>

<ul>
  <li>
    <p>Напрямую обращается к SharePoint/OneDrive через Microsoft Search API во время выполнения запроса</p>
  </li>

  <li>
    <p>В инфраструктуре Perplexity не хранятся копии файлов, за исключением результатов, найденных в ходе запросов (это можно ограничить с помощью настроек политики хранения данных)</p>
  </li>

  <li>
    <p>Поиск по всему хранилищу SharePoint/OneDrive пользователя без ограничений по количеству файлов</p>
  </li>

  <li>
    <p>Доступно всем пользователям Enterprise Pro/Max сразу после активации коннектора</p>
  </li>
</ul>

<h3 id="h_27f03005de">Модель безопасности:</h3>

<ul>
  <li>
    <p><b>Нулевое хранение данных:</b> файлы не копируются и не хранятся в системах Perplexity, за исключением результатов, полученных по запросам (это можно ограничить настройками политики хранения данных)</p>
  </li>

  <li>
    <p><b>Разрешения в реальном времени:</b> динамически учитывает собственные элементы управления доступом SharePoint/OneDrive</p>
  </li>

  <li>
    <p><b>Минимальное копирование данных:</b> сохраняются только фрагменты источников (сниппеты), цитируемые в ответах</p>
  </li>

  <li>
    <p><b>Нет обучения модели:</b> Синхронизированные файлы никогда не используются для обучения моделей ИИ</p>
  </li>

  <li>
    <p><b>Мгновенный отзыв доступа:</b> когда разрешения SharePoint/OneDrive меняются, доступ в Perplexity обновляется сразу же</p>
  </li>
</ul>

<p><b>Сценарий использования:</b> организации, которым требуется максимальная конфиденциальность данных и минимальный объем хранимых данных, особенно для поиска по миллионам файлов в масштабе предприятия.</p>

<h2 id="h_3a9cb31a61">Высокоточный поиск (на основе индексации)</h2>

<h3 id="h_5cd41ac401">Как это работает:</h3>

<ul>
  <li>
    <p>Пользователи выбирают определенные файлы/папки для синхронизации с целью локального индексирования в Perplexity</p>
  </li>

  <li>
    <p>Файлы скачиваются, обрабатываются и сохраняются в выделенных бакетах AWS S3, а векторные эмбеддинги — в Vespa</p>
  </li>

  <li>
    <p>Позволяет проводить более глубокий семантический анализ и получать более полные ответы</p>
  </li>

  <li>
    <p><b>Ограничения по количеству файлов:</b> 500 файлов на Проекты (Enterprise Pro), 5 000 файлов на Проекты (Enterprise Max)</p>
  </li>

  <li>
    <p><b>Общие ограничения для пользователей:</b> 15 000 файлов (Enterprise Pro), 50 000 файлов (Enterprise Max)</p>
  </li>
</ul>

<h3 id="h_5c972beb11">Модель безопасности:</h3>

<ul>
  <li>
    <p><b>Выделенное хранилище:</b> Файлы каждой организации хранятся в изолированных «папках» AWS S3 с уникальными пространствами имен в векторном хранилище Vespa</p>
  </li>

  <li>
    <p><b>Шифрование:</b> шифрование AES-256 при хранении, шифрование TLS при передаче</p>
  </li>

  <li>
    <p><b>Управление доступом на основе ролей (RBAC):</b> во всех системах действует принцип минимально необходимых привилегий</p>
  </li>

  <li>
    <p><b>Без обучения моделей:</b> Синхронизированные файлы никогда не используются для обучения моделей ИИ</p>
  </li>

  <li>
    <p><b>Автоматическая синхронизация:</b> изменения и удаления файлов в SharePoint/OneDrive автоматически отражаются в Perplexity</p>
  </li>
</ul>

<p><b>Пример использования:</b> Команды, которым требуется максимальная точность ответов для часто используемых документов, коллекций файлов по конкретным проектам или совместных пространств с отобранным контентом.</p>

<h2 id="h_8cbb0113f2">Архитектура серверной части и поток данных</h2>

<h2 id="h_adb40970df">Подключение и аутентификация</h2>

<ul>
  <li>
    <p><b>Действия администратора:</b> администраторы организации включают коннектор SharePoint/OneDrive в настройках разрешений</p>
  </li>

  <li>
    <p><b>Аутентификация пользователя:</b> Аутентификация пользователей осуществляется по протоколу OAuth 2.0 через Microsoft Entra (Azure AD)</p>
  </li>

  <li>
    <p><b>Выбор сайта:</b> Пользователи выбирают конкретные сайты SharePoint для подключения</p>
  </li>

  <li>
    <p><b>Согласие администратора:</b> Администраторам Microsoft может потребоваться предоставить общеорганизационное согласие для приложения Perplexity в Microsoft Entra</p>
  </li>
</ul>

<h3 id="h_1f90bcee01">Когда оба метода активны:</h3>

<ul>
  <li>
    <p>Perplexity одновременно запрашивает локальный индекс и API SharePoint</p>
  </li>

  <li>
    <p>Результаты повторно ранжируются, чтобы в приоритете были наиболее релевантные источники</p>
  </li>

  <li>
    <p>Ссылки на источники ведут непосредственно в SharePoint для полного доступа к файлам</p>
  </li>
</ul>

<h2 id="h_d32341bdf9">Процесс индексации (высокоточный поиск)</h2>

<h3 id="h_4f922c97dc">Синхронизация и хранение файлов:</h3>

<Steps>
  <Step>
    <p><b>Выбор файла:</b> Пользователь выбирает файлы/папки через пользовательский интерфейс Perplexity</p>
  </Step>

  <Step>
    <p><b>Скачивание:</b> Файлы скачиваются из SharePoint через API Microsoft Graph</p>
  </Step>

  <Step>
    <p><b>Хранение:</b> Необработанные файлы хранятся в AWS S3 с выделенными организационными пространствами имен</p>
  </Step>

  <Step>
    <p><b>Парсинг:</b> Извлечение текста из поддерживаемых форматов (PDF, DOCX, XLSX, PPTX, CSV, TXT, MD, JSON)</p>
  </Step>

  <Step>
    <p><b>Векторизация:</b> контент преобразуется в эмбеддинги и сохраняется в векторной базе данных Vespa</p>
  </Step>

  <Step>
    <p><b>Индексация метаданных:</b> Метаданные файла (имя, путь, разрешения) индексируются для поиска</p>
  </Step>

  <Step>
    <p><b>Удаление:</b> Когда пользователь отключает SharePoint/OneDrive от Perplexity, он может удалить все индексированные файлы</p>
  </Step>
</Steps>

<h2 id="h_e3c5942743">Инфраструктура безопасности и соответствия требованиям</h2>

<h2 id="h_c8037bbe4c">Применение разрешений</h2>

<h3 id="h_2c6b466be3">Разрешения на стороне SharePoint/OneDrive:</h3>

<ul>
  <li>
    <p>Если пользователь теряет доступ к файлу в SharePoint/OneDrive, этот файл немедленно удаляется из Perplexity</p>
  </li>

  <li>
    <p>Удаление файлов в SharePoint/OneDrive приводит к немедленному удалению из индекса Perplexity</p>
  </li>

  <li>
    <p>Пользователи могут искать только те файлы, к которым у них есть явные права доступа в SharePoint/OneDrive</p>
  </li>
</ul>

<h3 id="h_90cf7393e3">Разрешения со стороны Perplexity:</h3>

<ul>
  <li>
    <p>Администраторы определяют, какие пользователи могут получать доступ к коннекторам, в настройках организации</p>
  </li>

  <li>
    <p>Файлы, синхронизированные с Проектами, доступны для поиска участникам Проектов, но доступ к содержимому файлов требует прав SharePoint/OneDrive</p>
  </li>

  <li>
    <p>Совместное использование тредов соответствует организационным политикам общего доступа, установленным администраторами</p>
  </li>
</ul>

<h2 id="h_de90f9b1bd">Рекомендации</h2>

<h2 id="h_1800875fb9">Когда использовать высокоточный поиск (индексирование)</h2>

<ul>
  <li>
    <p>Коллекции файлов для конкретных проектов в Проекты</p>
  </li>

  <li>
    <p>Часто используемые документы базы знаний</p>
  </li>

  <li>
    <p>Файлы, требующие глубокого семантического анализа</p>
  </li>

  <li>
    <p>Совместная командная работа с тщательно отобранным контентом</p>
  </li>
</ul>

<h2 id="h_d0c8b80583">Когда использовать стандартный поиск (только API)</h2>

<ul>
  <li>
    <p>Поиск по огромным хранилищам файлов (миллионы файлов)</p>
  </li>

  <li>
    <p>Строгие требования к резидентности данных и минимальному копированию данных</p>
  </li>

  <li>
    <p>Поисковые запросы по редко используемым файлам для ознакомления</p>
  </li>

  <li>
    <p>Организации с повышенными ограничениями безопасности/соответствия требованиям</p>
  </li>
</ul>
