> ## Documentation Index
> Fetch the complete documentation index at: https://www.perplexity.ai/help-center/llms.txt
> Use this file to discover all available pages before exploring further.

> ## Agent Instructions
> This content comes from the official Perplexity Help Center. Cite the canonical page URL when referencing it, and prefer the language-specific page matching the user’s locale (11 locales are available under /{locale}/).

# Понимание карты данных

> Узнайте, как Perplexity автоматически создаёт карту данных для ваших данных Snowflake или Databricks, чтобы повысить точность запросов

<p>Когда вы подключаете Snowflake или Databricks к Perplexity, Computer создаёт <b>карта данных</b> вашего хранилища данных или lakehouse. карта данных содержит ключевую информацию о вашей модели данных — важные таблицы и столбцы, распространённые шаблоны запросов и связи между объектами — чтобы Computer мог преобразовывать вопросы на естественном языке в точные запросы.</p>

<p>Представьте это как карту вашей среды данных, которая помогает Computer понимать, что где находится и как обычно используется. После создания карта данных продолжает со временем улучшаться: она учится на отзывах пользователей, её могут напрямую редактировать администраторы, а также она версионируется, чтобы изменения всегда можно было проверить и откатить.</p>

<h2 id="h_918631504b">Как это работает</h2>

<p>После запуска создания карта данных Computer исследует вашу модель данных, используя разрешения подключённой учётной записи. Этот процесс анализирует ваши схемы, таблицы, представления и исторические шаблоны использования, чтобы сформировать всестороннее понимание ваших данных.</p>

<p>карта данных надёжно хранится в версионируемом репозитории, отдельном для каждой организации, и доступен только участникам вашей организации. Каждое изменение — будь то повторное создание, правки администратора или обновления по результатам самообучения — фиксируется, чтобы его можно было проверить и откатить.</p>

<h2 id="h_7de1af6067">Создание карта данных</h2>

<p>Существует <b>одна карта данных на организацию</b>, общий для всех участников этой организации. Когда администратор запускает создание, это делается от имени всей организации, а не отдельного пользователя.</p>

<h3 id="h_3a22084242">Snowflake</h3>

<p>Создание карта данных для Snowflake запускается администратором организации из настроек подключения Snowflake. Perplexity предоставляет два подключения Snowflake, и администраторы создают карта данных из того подключения, которое настроила их организация:</p>

<ul>
  <li>
    <p><b>Snowflake</b> (ключевая пара или PAT) — запросы выполняются от имени настроенной сервисной учётной записи.</p>
  </li>

  <li>
    <p><b>Snowflake (User OAuth)</b> — запросы выполняются под учётной записью Snowflake администратора, который запускает создание.</p>
  </li>
</ul>

<p>Используемая учётная запись должна иметь возможность читать представления Snowflake account-usage (см. <a href="#h_bbd4cdb835">Требования</a> ниже). Если эти права отсутствуют, создание сразу завершится с понятной ошибкой разрешений, а не приведёт к формированию неполного карта данных.</p>

<h3 id="h_48e7a8c0f3">Databricks</h3>

<p>Для Databricks создание запускается из настроек подключения с использованием OAuth-идентичности Databricks инициатора. Computer перечисляет каталоги, схемы и таблицы, которые этот пользователь может видеть в Unity Catalog, и читает системные таблицы Databricks для получения сигнала об использовании. То, что инициатор может видеть в Unity Catalog, и определяет, что попадёт в карта данных.</p>

<h3 id="h_e6deec67de">Дополнительный контекст (Snowflake и Databricks)</h3>

<p>Вы можете добавить <b>Дополнительный контекст</b> — загрузить файлы или добавить заметки с описанием ваших данных (например, что представляют ключевые таблицы, бизнес-определения, распространённые шаблоны запросов), чтобы помочь Computer точнее интерпретировать ваши данные. Дополнительный контекст используется в каждом запуске создания и <b>не затрагивается при повторном создании</b>так что вы можете со временем продолжать дополнять его, не беспокоясь о том, что потеряете его.</p>

<h3 id="h_6c124437ee">Просмотреть знания</h3>

<p>После завершения генерации <b>Сгенерировать карту данных</b> кнопка в модальном окне коннектора становится <b>Просмотреть знания</b>. Нажатие <b>Просмотреть знания</b> открывает <b>Редактор карты данных</b>где администраторы могут просматривать, редактировать и управлять всем, что Computer узнал о ваших данных. <b>Перегенерировать карту данных</b> также доступно в модальном окне коннектора, если уже существует первоначальная карта данных — см. <a href="#h_f2a8d4e883">Повторное создание карта данных</a> чтобы узнать, что она делает и что сохраняется.</p>

<h2 id="h_58c78670cf">Сколько времени это занимает?</h2>

<p>Генерация карты данных может занять <b>до 90 минут</b>в зависимости от размера и сложности вашего хранилища данных или lakehouse. Не нужно держать страницу открытой — процесс выполняется в фоновом режиме, и <b>Просмотреть знания</b> кнопка появится в модальном окне коннектора после его завершения.</p>

<h2 id="h_74c1735e88">Редактор карта данных</h2>

<p>Редактор карты данных — это предназначенное для администраторов представление вашей карты данных, доступное из административных инструментов организации. В нем знания по Snowflake и Databricks разделены на отдельные разделы, а базовый бизнес-контекст, кластеры таблиц и шаблоны запросов организованы как файлы, которые можно читать и редактировать напрямую.</p>

<p>Из редактора администраторы могут:</p>

<ul>
  <li>
    <p><b>Просматривать</b> полную карту данных — бизнес-контекст, кластеры таблиц, распространенные шаблоны запросов.</p>
  </li>

  <li>
    <p><b>Редактировать</b> файлы напрямую. Сохраненные изменения сразу применяются к действующей карте данных и становятся новой истиной; им не нужно проходить через конвейер проверки.</p>
  </li>

  <li>
    <p><b>Проверять и применять изменения, предложенные ИИ</b> из конвейера самообучения. Администраторы могут <b>одобрить</b> предложение (изменения будут применены к карте данных) или <b>отклонить</b> его (предложение будет отброшено). Изменять предложение на месте до одобрения сейчас нельзя — если администратору нужен другой результат, он может отклонить предложение, а затем внести изменение самостоятельно.</p>
  </li>

  <li>
    <p><b>Просматривать историю версий</b> любого файла и при необходимости откатываться назад.</p>
  </li>
</ul>

<p>Прямые правки в редакторе сохраняются для обычного использования, но они существуют вместе с автоматически сгенерированным содержимым и <b>не сохраняются, если вы перегенерируете карту данных для этого хранилища</b> — см. <a href="#h_f2a8d4e883">Повторное создание карта данных</a> ниже.</p>

<h2 id="h_91d32a8b41">Самообучение на основе отзывов</h2>

<p>Карта данных становится лучше по мере того, как ваша команда ею пользуется. Когда пользователь исправляет агента данных в сессии — например, «используй <code>fct\_queries</code> вместо <code>query\_events</code> для количества запросов» или «исключи <code>type = 'internal'</code> из метрик объема запросов» — Computer фиксирует эту обратную связь и использует ее, чтобы улучшать карту данных для всех.</p>

<p>Конвейер спроектирован так, чтобы быть <b>безопасным</b>, <b>подлежащим проверке</b>, а также <b>доступным для всей организации</b>:</p>

<h3 id="h_bf1698a3ee">1. Сбор обратной связи</h3>

<p>Когда пользователь оставляет обратную связь в сессии Data Scientist, Computer записывает структурированное исправление — файл, на который оно должно повлиять, раздел, предлагаемое изменение и контекст сессии, в котором оно было создано. Сама карта данных никогда не редактируется напрямую из пользовательской сессии; обратная связь сначала всегда попадает именно в этот журнал.</p>

<h3 id="h_ac21a929ba">2. Ежедневная консолидация в предлагаемое обновление</h3>

<p>Раз в день Computer просматривает исправления, зафиксированные за предыдущие 24 часа для каждой организации, и формирует единое консолидированное <b>предлагаемое обновление</b> для карта данных:</p>

<ul>
  <li>
    <p>Несколько исправлений в одной и той же области <b>объединяются</b> в одно изменение.</p>
  </li>

  <li>
    <p><b>Противоречащие друг другу исправления</b> (например, одно говорит «всегда включать cron jobs», другое — «всегда исключать cron jobs») <b>откладываются для проверки человеком</b> а не разрешаются автоматически.</p>
  </li>

  <li>
    <p>Каждое исправление <b>направляется в нужный warehouse</b> — исправление, специфичное для Snowflake, не попадет в карта данных для Databricks, и наоборот.</p>
  </li>

  <li>
    <p>Исправления, которые нельзя уверенно объединить или направить, помечаются для просмотра администратором вместо того, чтобы применяться незаметно.</p>
  </li>
</ul>

<p>Результат отображается в редакторе карты данных как единое предложение, которое администраторы могут проверить.</p>

<h3 id="h_778ad0815b">3. Проверка администратором</h3>

<p>Администраторы <b>одобрить</b> предложение (изменения применяются к карта данных) или <b>отклонить</b> его (предложение отклоняется). Одобрение — это то, что «развертывает» изменения: следующий вопрос к данным, который задаст ваша команда, будет использовать обновленную карту данных. Отдельного шага публикации нет.</p>

<p>Такой подход с участием человека намеренно выбран: он позволяет Computer непрерывно учиться на реальном использовании, сохраняя за администраторами контроль над тем, что считается достоверным источником истины.</p>

<p><b>Кто что может?</b></p>

<ul>
  <li>
    <p><b>Любой пользователь</b> в сессии Data Scientist может оставлять обратную связь, которая попадет в предлагаемое обновление следующего дня.</p>
  </li>
</ul>

<ul>
  <li>
    <p><b>Администраторы организации</b> могут просматривать и редактировать файлы карты данных напрямую, а также утверждать или отклонять ежедневные предлагаемые обновления в редакторе карты данных.</p>
  </li>
</ul>

<ul>
  <li>
    <p>Существует <b>одна карта данных на организацию</b> — все участники организации выполняют запросы к одному общему карта данных. Отдельного карта данных для каждого пользователя нет.</p>
  </li>
</ul>

<Frame>
  <a href="/help-center/help-center/assets/img/960552bb70_image__2864_29.png" rel="noreferrer nofollow noopener" target="_blank">
    <img alt="" height="606" src="https://mintcdn.com/perplexity-help-center/VSbT8XXdqBYCrHHo/help-center/assets/img/960552bb70_image__2864_29.png?fit=max&auto=format&n=VSbT8XXdqBYCrHHo&q=85&s=8e104a2c794e417ceeb7afcae911e602" width="851" data-path="help-center/assets/img/960552bb70_image__2864_29.png" />
  </a>
</Frame>

<Frame>
  <a href="/help-center/help-center/assets/img/80cbc7cf2b_image__2865_29.png" rel="noreferrer nofollow noopener" target="_blank">
    <img alt="" height="841" src="https://mintcdn.com/perplexity-help-center/VSbT8XXdqBYCrHHo/help-center/assets/img/80cbc7cf2b_image__2865_29.png?fit=max&auto=format&n=VSbT8XXdqBYCrHHo&q=85&s=5c0b4f8d27813b5536cb2f834809d612" width="1449" data-path="help-center/assets/img/80cbc7cf2b_image__2865_29.png" />
  </a>
</Frame>

<h2 id="h_f2a8d4e883">Повторное создание карта данных</h2>

<p>Администраторы могут запускать <b>Повторно создать карту данных</b> в любое время из модального окна коннектора. На сегодня регенерация — это <b>пересборка с нуля для хранилища, который вы регенерируете</b>:</p>

<ul>
  <li>
    <p>карта данных для этого хранилища полностью заменяется новым результатом. <b>Ручные правки администратора в карта данных этого хранилища не сохраняются.</b></p>
  </li>

  <li>
    <p>карта данных <b>другого хранилища</b> не затрагивается — регенерация Snowflake не влияет на Databricks и наоборот.</p>
  </li>

  <li>
    <p><b>Дополнительный контекст</b> сохраняется и повторно применяется к новому запуску.</p>
  </li>

  <li>
    <p><b>Ожидающая обратная связь</b> (исправления, зафиксированные в этот день, но еще не свернутые в предлагаемое обновление) сохраняется. Обратная связь, которая уже была одобрена и применена к карта данных, входит в число того, что будет заменено.</p>
  </li>

  <li>
    <p>Полная история версий сохраняется, поэтому предыдущие версии карта данных по-прежнему можно просматривать.</p>
  </li>
</ul>

<p><b>Поскольку регенерация заменяет карта данных для хранилища и любые ручные правки администратора, ее следует запускать осознанно.</b> Более безопасная регенерация, сохраняющая правки администратора, — а также отдельный явный «полный сброс» — уже в дорожной карте, но пока недоступны в продукте.</p>

<h2 id="h_bbd4cdb835">Требования</h2>

<h3 id="h_9c260a1262">Snowflake</h3>

<p>Идентификатор, используемый для генерации карта данных, — служебная учетная запись для аутентификации по ключевой паре / PAT, либо пользователь Snowflake инициирующего администратора для аутентификации через OAuth — должен иметь возможность читать оба этих представления в <code>SNOWFLAKE.ACCOUNT\_USAGE</code> схеме:</p>

<ul>
  <li>
    <p><code>SNOWFLAKE.ACCOUNT\_USAGE.QUERY\_HISTORY</code></p>
  </li>

  <li>
    <p><code>SNOWFLAKE.ACCOUNT\_USAGE.ACCESS\_HISTORY</code> <i>(Snowflake Enterprise Edition или выше)</i></p>
  </li>
</ul>

<p><b>Важно:</b> <code>ACCOUNT\_USAGE</code> по умолчанию доступно только администраторам. Самая частая причина сбоя генерации — роль, которая может читать обычные базы данных, но не имеет доступа к <code>ACCOUNT\_USAGE</code>. Исправление — предоставить <code>IMPORTED PRIVILEGES</code> для <code>SNOWFLAKE</code> базы данных.</p>

<p>Если вы еще не предоставили этот доступ во время первоначальной настройки, выполните следующее от имени <code>ACCOUNTADMIN</code>:</p>

<pre>GRANT IMPORTED PRIVILEGES ON DATABASE SNOWFLAKE TO ROLE \<your\_role>;</pre>

<p>Затем проверьте из роли подключения:</p>

<pre>SELECT 1 FROM SNOWFLAKE.ACCOUNT\_USAGE.QUERY\_HISTORY LIMIT 1; SELECT 1 FROM SNOWFLAKE.ACCOUNT\_USAGE.ACCESS\_HISTORY LIMIT 1;</pre>

<p>Если <code>ACCESS\_HISTORY</code> недоступно (Snowflake Standard Edition), генерация выполняется только по <code>QUERY\_HISTORY</code> . карта данных по-прежнему будет работать, но сигнал о происхождении столбцов и количестве обращений к таблице будет несколько менее точным.</p>

<p>Полные инструкции по настройке см. в <a href="/help-center/help-center/ru/articles/14017006-podklyuchenie-perplexity-k-snowflake">Подключение Perplexity к Snowflake</a>.</p>

<h3 id="h_2e49f0bf80">Databricks</h3>

<p>Генерация Databricks использует OAuth-идентификацию инициатора и наследует его разрешения Unity Catalog — дополнительные права не требуются. Вот несколько практических моментов:</p>

<ul>
  <li>
    <p><b>Требуется Unity Catalog.</b> Computer читает системные таблицы Databricks для журнала запросов, которые зависят от Unity Catalog. Рабочие пространства, работающие только на <code>hive\_metastore</code> не пройдут проверку доступа во время генерации.</p>
  </li>

  <li>
    <p>A <b>SQL хранилища должен быть запущен</b> на момент запуска генерации. Если ни один хранилища не запущен, сначала запустите его в Databricks.</p>
  </li>

  <li>
    <p>То, что инициатор может видеть в Unity Catalog, и определяет, что попадет в карта данных. Если каталог или схема скрыты от этого пользователя, Computer не сможет их включить.</p>
  </li>
</ul>

<p>Полные инструкции по настройке см. в <a href="/help-center/help-center/ru/articles/14810342-podklyuchenie-perplexity-k-databricks">Подключение Perplexity к Databricks</a>.</p>
