> ## Documentation Index
> Fetch the complete documentation index at: https://www.perplexity.ai/help-center/llms.txt
> Use this file to discover all available pages before exploring further.

> ## Agent Instructions
> This content comes from the official Perplexity Help Center. Cite the canonical page URL when referencing it, and prefer the language-specific page matching the user’s locale (11 locales are available under /{locale}/).

# データマップについて

> Perplexity が Snowflake または Databricks データに対してクエリの精度を向上させるために自動的にデータマップを生成する方法をご確認ください

<p>Snowflake または Databricks を Perplexity に接続すると、Computer はデータウェアハウスまたはレイクハウスの<b>データマップ</b>を生成します。データマップは、Computer が自然言語の質問を正確なクエリに変換できるよう、データモデルに関する重要な情報（重要なテーブルとカラム、一般的なクエリパターン、オブジェクト間の関係）を取得します。</p>

<p>これはデータ環境のマップとして機能し、Computer がどこに何があり、通常どのように使用されているかを理解するのに役立ちます。一度生成されると、データマップは継続的に改善されます。ユーザーフィードバックから学習し、管理者が直接編集でき、変更は常にレビューおよびロールバックできるようにバージョン管理されます。</p>

<h2 id="h_918631504b">仕組み</h2>

<p>データマップの生成が開始されると、Computer は接続されたアカウントの権限を使用してデータモデルを調査します。このプロセスではスキーマ、テーブル、ビュー、過去の使用パターンを検証して、データの包括的な理解を構築します。</p>

<p>データマップは、組織ごとのバージョン管理されたリポジトリに安全に保存され、組織のメンバーのみがアクセスできます。</p>

<h2 id="h_7de1af6067">データマップの生成</h2>

<p>データマップは <b>組織につき1つ</b>で、その組織のすべてのメンバーが共有します。管理者が生成を実行する際は、個人ではなく組織全体の代表として行います。</p>

<h3 id="h_3a22084242">Snowflake</h3>

<p>Snowflake のデータマップ生成は、Snowflake コネクタの設定から組織管理者が開始します。Perplexity には 2 つの Snowflake コネクタがあり、管理者は組織が設定したコネクタからデータマップを生成します：</p>

<ul>
  <li>
    <p><b>Snowflake</b> （キーペアまたは PAT）— クエリは設定されたサービスアカウントとして実行されます。</p>
  </li>

  <li>
    <p><b>Snowflake（ユーザー OAuth）</b> — クエリは生成を開始した管理者の Snowflake ID で実行されます。</p>
  </li>
</ul>

<p>使用される ID は、Snowflake のアカウント使用状況ビューを読み取れる必要があります（ <a href="#h_bbd4cdb835">要件</a> を参照）。これらの権限が不足している場合、生成は部分的なデータマップを生成するのではなく、明確な権限エラーで最初から失敗します。</p>

<h3 id="h_48e7a8c0f3">Databricks</h3>

<p>Databricks の場合、生成はコネクタ設定から開始者の Databricks OAuth ID を使用して開始されます。Computer は Unity Catalog でそのユーザーが見ることができるカタログ、スキーマ、テーブルを列挙し、使用シグナルのために Databricks システムテーブルを読み取ります。開始者が Unity Catalog で見ることができるものが、データマップに含まれる内容を定義します。</p>

<h3 id="h_e6deec67de">補足コンテキスト（Snowflake および Databricks）</h3>

<p><b>補足コンテキスト</b>を追加できます。ファイルのアップロードやメモの追加でデータを説明でき（例：重要なテーブルが表すもの、ビジネス定義、一般的なクエリパターン）、Computer がデータをより正確に解釈できるようになります。補足コンテキストはすべての生成実行に取り込まれ、<b>再生成によって影響を受けません</b>。そのため、時間をかけて追加し続けても、失う心配はありません。</p>

<h3 id="h_6c124437ee">ナレッジの表示</h3>

<p>生成が完了すると、コネクタモーダルの <b>データマップを生成</b> ボタンが <b>ナレッジを表示</b>に変わります。 <b>ナレッジを表示</b> をクリックすると、 <b>データマップエディター</b>が開き、管理者は Computer がデータについて学んだすべてのコンテンツを閲覧、編集、管理できます。 <b>データマップを再生成</b> は、初期データマップが作成された後にコネクタモーダルから使用できます。動作内容と保持されるものについては、<a href="#h_f2a8d4e883">データマップの再生成</a>をご覧ください。</p>

<h2 id="h_58c78670cf">どのくらい時間がかかりますか？</h2>

<p>データマップの生成には <b>最大90分</b>かかる場合があります（データウェアハウスまたはレイクハウスのサイズと複雑さによって異なります）。ページを開いたままにしておく必要はありません。プロセスはバックグラウンドで実行され、 <b>ナレッジを表示</b> ボタンが完了後にコネクタモーダルに表示されます。</p>

<h2 id="h_74c1735e88">データマップエディター</h2>

<p>データマップエディターは管理者向けのデータマップビューで、組織管理者ツールからアクセスできます。Snowflake と Databricks のナレッジを個別のセクションに分離し、基礎となるビジネスコンテキスト、テーブルクラスター、クエリパターンは直接読み書きできるファイルとして整理されています。</p>

<p>エディターから管理者は以下の操作が可能です：</p>

<ul>
  <li>
    <p><b>閲覧</b> （データマップ全体：ビジネスコンテキスト、テーブルクラスター、一般的なクエリパターン）</p>
  </li>

  <li>
    <p><b>編集</b> （ファイルを直接編集。保存された編集は即座にライブデータマップに適用され、新しいグラウンドトゥルースになります。レビューパイプラインを経る必要はありません）</p>
  </li>

  <li>
    <p><b>AI が提案した変更のレビューと対応</b> （自己学習パイプラインからの変更）。管理者は <b>承認</b> （変更がデータマップに適用）または <b>却下</b> （提案が破棄されます）。承認前に提案をその場で修正する機能は現在サポートされていません — 別の結果を望む管理者は、却下した後に自分で編集を行うことができます。</p>
  </li>

  <li>
    <p><b>バージョン履歴を表示</b> して、必要に応じてロールバックできます。</p>
  </li>
</ul>

<p>エディターでの直接編集は通常使用では永続的ですが、自動生成されたコンテンツと共存しており、 <b>そのウェアハウスのデータマップを再生成すると保持されません</b>。詳しくは下記の<a href="#h_f2a8d4e883">データマップの再生成</a>をご覧ください。</p>

<h2 id="h_91d32a8b41">フィードバックからの自己学習</h2>

<p>チームが使うほど、データマップは改善されます。ユーザーがセッション内でデータエージェントを修正すると（例：「クエリカウントには <code>query\_events</code> の代わりに <code>fct\_queries</code> を使用してください」または「クエリボリュームメトリクスから <code>type = 'internal'</code> を除外してください」）、Computer はそのフィードバックを記録してデータマップの改善に使用します。</p>

<p>パイプラインは、<b>安全</b>かつ<b>レビュー可能</b>で、<b>組織全体で共有される</b>よう設計されています：</p>

<h3 id="h_bf1698a3ee">1. フィードバックの収集</h3>

<p>ユーザーが Data Scientist セッションでフィードバックを提供すると、Computer は構造化された修正（影響を受けるファイル、該当セクション、提案される変更、そのきっかけとなったセッションのコンテキスト）を記録します。データマップ自体がユーザーセッションから直接編集されることはなく、フィードバックは必ず最初にこのログに記録されます。</p>

<h3 id="h_ac21a929ba">2. 提案された更新への日次コンパクション</h3>

<p>1日に1回、Computer は各組織の過去24時間に記録された修正を確認し、データマップに対する単一の統合された<b>提案された更新</b>を作成します：</p>

<ul>
  <li>
    <p>同じ領域への複数の修正は<b>1つの編集にまとめられます</b>。</p>
  </li>

  <li>
    <p><b>矛盾する修正</b> （例：一方が「常に cron ジョブを含める」、もう一方が「常に cron ジョブを除外する」と言う場合）は <b>人間によるレビューのために保留</b> 自動解決されるのではなく。</p>
  </li>

  <li>
    <p>各修正は<b>適切なウェアハウスにルーティングされます</b> — Snowflake 固有の修正が Databricks のデータマップに影響することはなく、その逆も同様です。</p>
  </li>

  <li>
    <p>自信を持ってマージまたはルーティングできない修正は、サイレントに適用されるのではなく、管理者が確認するためにフラグが立てられます。</p>
  </li>
</ul>

<p>結果は管理者がレビューできる単一の提案としてデータマップエディターに表示されます。</p>

<h3 id="h_778ad0815b">3. 管理者レビュー</h3>

<p>管理者 <b>承認</b> （変更がデータマップに適用）または <b>却下</b> （提案が破棄されます）。承認が変更を「デプロイ」します — チームが次にデータに関する質問をすると、更新されたデータマップが使用されます。別途公開ステップはありません。</p>

<p>この人間参加型パターンは意図的なものです。Computer がリアルな使用から継続的に学習しながら、管理者がグラウンドトゥルースとして信頼されるものを制御し続けられるようにします。</p>

<p><b>誰が何をできるか？</b></p>

<ul>
  <li>
    <p><b>すべてのユーザー</b> データサイエンティストスレッドでフィードバックを提供でき、翌日の提案された更新に反映されます。</p>
  </li>
</ul>

<ul>
  <li>
    <p><b>組織の管理者</b>は、データマップファイルを直接参照および編集でき、データマップエディターで日次の提案された更新を承認または却下できます。</p>
  </li>
</ul>

<ul>
  <li>
    <p>データマップは <b>組織につき1つ</b> — 組織の全メンバーが同じ共有データマップに対してクエリを実行します。ユーザーごとのデータマップはありません。</p>
  </li>
</ul>

<Frame>
  <a href="/help-center/help-center/assets/img/960552bb70_image__2864_29.png" rel="noreferrer nofollow noopener" target="_blank">
    <img alt="" height="606" src="https://mintcdn.com/perplexity-help-center/VSbT8XXdqBYCrHHo/help-center/assets/img/960552bb70_image__2864_29.png?fit=max&auto=format&n=VSbT8XXdqBYCrHHo&q=85&s=8e104a2c794e417ceeb7afcae911e602" width="851" data-path="help-center/assets/img/960552bb70_image__2864_29.png" />
  </a>
</Frame>

<Frame>
  <a href="/help-center/help-center/assets/img/80cbc7cf2b_image__2865_29.png" rel="noreferrer nofollow noopener" target="_blank">
    <img alt="" height="841" src="https://mintcdn.com/perplexity-help-center/VSbT8XXdqBYCrHHo/help-center/assets/img/80cbc7cf2b_image__2865_29.png?fit=max&auto=format&n=VSbT8XXdqBYCrHHo&q=85&s=5c0b4f8d27813b5536cb2f834809d612" width="1449" data-path="help-center/assets/img/80cbc7cf2b_image__2865_29.png" />
  </a>
</Frame>

<h2 id="h_f2a8d4e883">データマップの再生成</h2>

<p>管理者は実行できます <b>データマップを再生成</b> コネクタモーダルからいつでも実行できます。現在、再生成は <b>再生成するウェアハウスの最初からの再構築</b>:</p>

<ul>
  <li>
    <p>そのウェアハウスのデータマップは新しい結果で完全に置き換えられます。 <b>そのウェアハウスのデータマップへの手動の管理者編集は保持されません。</b></p>
  </li>

  <li>
    <p><b>もう一方のウェアハウスの</b>データマップはそのまま維持されます — Snowflake を再生成しても Databricks のデータマップには影響せず、その逆も同様です。</p>
  </li>

  <li>
    <p><b>補足コンテキスト</b> が保持され、新しい実行に再適用されます。</p>
  </li>

  <li>
    <p><b>保留中のフィードバック</b> （その日に記録されたがまだ提案された更新にまとめられていない修正）は保持されます。すでに承認されてデータマップに適用されたフィードバックは、置き換えられる部分に含まれます。</p>
  </li>

  <li>
    <p>完全なバージョン履歴は保持されるため、データマップの以前のバージョンは引き続き検査できます。</p>
  </li>
</ul>

<p><b>再生成はウェアハウスのデータマップとその管理者編集を置き換えるため、意図的に実行する必要があります。</b> 管理者編集を保持するより安全な再生成と、別途の明示的な「完全リセット」については、ロードマップに含まれていますが、現在はまだ提供されていません。</p>

<h2 id="h_bbd4cdb835">要件</h2>

<h3 id="h_9c260a1262">Snowflake</h3>

<p>データマップの生成に使用されるアイデンティティ（キーペア/PAT 認証の場合はサービスアカウント、OAuth 認証の場合は開始管理者の Snowflake ユーザー）は、<code>SNOWFLAKE.ACCOUNT\_USAGE</code> スキーマの次の2つのビューを読み取れる必要があります：</p>

<ul>
  <li>
    <p><code>SNOWFLAKE.ACCOUNT\_USAGE.QUERY\_HISTORY</code></p>
  </li>

  <li>
    <p><code>SNOWFLAKE.ACCOUNT\_USAGE.ACCESS\_HISTORY</code> <i>（Snowflake Enterprise Edition 以上）</i></p>
  </li>
</ul>

<p><b>重要：</b> <code>ACCOUNT\_USAGE</code> はデフォルトで管理者専用です。生成が失敗する最も一般的な原因は、通常のデータベースを読み取ることはできるが、 <code>ACCOUNT\_USAGE</code>にアクセスできないロールです。修正方法は <code>IMPORTED PRIVILEGES</code> on the <code>SNOWFLAKE</code> database.</p>

<p>初期セットアップ時にこのアクセスをまだ付与していない場合は、次のコマンドを <code>ACCOUNTADMIN</code>:</p>

<pre>GRANT IMPORTED PRIVILEGES ON DATABASE SNOWFLAKE TO ROLE \<your\_role>;</pre>

<p>次に、接続ロールから確認します：</p>

<pre>SELECT 1 FROM SNOWFLAKE.ACCOUNT\_USAGE.QUERY\_HISTORY LIMIT 1; SELECT 1 FROM SNOWFLAKE.ACCOUNT\_USAGE.ACCESS\_HISTORY LIMIT 1;</pre>

<p>If <code>ACCESS\_HISTORY</code> が利用できない場合（Snowflake Standard Edition）、生成は <code>QUERY\_HISTORY</code> のみにフォールバックします。データマップは引き続き機能しますが、列の系譜とテーブルアクセスカウントに関するシグナルの精度がやや低下します。</p>

<p>完全なセットアップ手順については、<a href="/help-center/help-center/ja/articles/14017006-perplexityとsnowflakeの連携">PerplexityとSnowflakeの連携</a>をご覧ください。</p>

<h3 id="h_2e49f0bf80">Databricks</h3>

<p>Databricks の生成では、開始者の OAuth アイデンティティが使用され、Unity Catalog の権限が継承されます。追加の権限付与は不要です。知っておくべき実用的な注意点がいくつかあります：</p>

<ul>
  <li>
    <p><b>Unity Catalog が必要です。</b> Computer はクエリ履歴の Databricks システムテーブルを読み取ります（Unity Catalog に依存）。<code>hive\_metastore</code> のみで動作するワークスペースは、生成中のアクセスチェックに失敗します。</p>
  </li>

  <li>
    <p>A <b>SQL ウェアハウスが実行中である必要があります</b> 生成が開始されるとき。ウェアハウスが実行されていない場合は、最初に Databricks でウェアハウスを起動してください。</p>
  </li>

  <li>
    <p>開始者が Unity Catalog で見ることができるものが、データマップに含まれる内容を定義します。カタログまたはスキーマがそのユーザーから隠されている場合、Computer はそれを含めることができません。</p>
  </li>
</ul>

<p>完全なセットアップ手順については、<a href="/help-center/help-center/ja/articles/14810342-databricksとperplexityの連携">DatabricksとPerplexityの連携</a>をご覧ください。</p>
