Válaszok az adatraktárból

Ismerje meg, hogyan csatlakoztatható a Perplexity Computer a Snowflake-hez, és hogyan kaphat megbízható adatalapú válaszokat egyszerű nyelven.

  • Noah Yonack

    Member of Data Staff, Perplexity

  • Patrick Summers

    Founding Enterprise Growth Lead

  • Csatlakoztassa a Computert a Snowflake-hez vagy a Databrickshez, miközben megőrzi a meglévő szerepköröket, jogosultságokat és biztonsági vezérlőket.
  • Hozzon létre egy adattérképet, amely rögzíti az üzleti definíciókat, a táblakapcsolatokat és a lekérdezési mintákat a megbízhatóbb elemzés érdekében.
  • Hozzon létre jelentéseket, irányítópultokat és ismétlődő monitoring munkafolyamatokat adatraktár-adatok és egyéb jóváhagyott vállalati források felhasználásával.

Lekérdezési példák

Gyakran ismételt kérdések

A Computer csatlakoztatása adatraktárakhoz

Hogyan dolgoznak az adatelemző csapatok a Computerrel?

A Computer természetes nyelvi felületet biztosíthat az üzleti csapatok számára a felügyelt adatraktár-adatokhoz, és kombinálhatja azokat más jóváhagyott rendszerek kontextusával. Az ügyfelek csökkentették az ismétlődő adatkéréseket, és lehetővé tették az adatelemző csapat számára, hogy lebih időt töltsön a modellezéssel, az irányítással és a stratégiai elemzéssel. Ez nem váltja fel az adatraktárt, a szemantikai réteget vagy az adatminőség-biztosítási erőfeszítéseket.

Mi a legjobb módja a kezdésnek?

Kezdje egy jól ismert üzleti területtel és egy kis felhasználói csoporttal. Konfigurálja a felhasználói OAuth-ot, korlátozza a hozzáférést a jóváhagyott sémákhoz és eszközökhöz, dokumentálja a kanonikus metrikákat, generálja és tekintse át az adattérképet, valamint tesztelje a reprezentatív kérdéseket a megbízható jelentések alapján. Csak akkor terjeszsze ki a kört, ha az adatelemző csapat elégedett az SQL-minőséggel, a jogosultságokkal, a költségekkel és a felhasználói viselkedéssel.

Képes a Computer proaktívan figyelni a metrikákat és az adatfolyamokat?

Az ütemezett feladatok ismétlődő ellenőrzéseket futtathatnak a támogatott források ellen, és a konfigurált csatornákon keresztül kézbesíthetik az eredményeket. A felhasználóknak meg kell határozniuk az adatforrást, a gyakoriságot, a küszöbértékeket, a várt kimenetet, a felelőst és eszkalációs utat.

Architektúra és irányítás

Mi az az adattérkép, és kinek kell felelnie érte?

Az adattérkép egy szervezet szintű kontextusréteg, amely rögzíti a fontos táblákat, oszlopokat, kapcsolatokat, lekérdezési mintákat és az üzleti kontextust. Segít a Computernek az üzleti kérdések adatraktárból származó lekérdezésekké alakításában. Egy adatplatform, analitikai mérnöki csapat vagy adatirányítási felelős tartsa karban, határozza meg a hiteles metrikákat, tekintse át a javasolt módosításokat, és adja hozzá a tartós kiegészítő kontextust.

Az adatraktár marad a nyilvántartási rendszer?

Igen. Az adattérkép kontextust tárol az adatokban való navigálásról. A jelenlegi metrikákhoz továbbra is aktív kapcsolat szükséges, és az SQL az ügyfél Snowflake- vagy Databricks-környezetében hajtódik végre. Az adatraktár marad az adatok, a számítási kapacitás, a jogosultságok, a lekérdezési előzmények és a hozzáférési házirendek hiteles forrása.

Hogyan történik az identitás és a jogosultságok betartatása?

A Computer felhasználói OAuth-ot használ a csatlakozóihoz. Minden személy a saját egyéni fiókjával jelentkezik be, és a lekérdezések az adott fiók konfigurált szerepkör-kontextusában futnak. Az adatraktár-alapú jogosultságok, sószűrők, oszlopbeli szabályzatok és a szerepkör-konfiguráció maradnak az irányító vezérlők. Bizonyos csatlakozókhoz megosztott szolgáltatásfiók is támogatott, de ez a felhasználók egyéni engedélyei helyett a szolgáltatásfiók hozzáférési modelljét érvényesíti.

Képes a Computer egyeztetni az adatokat az adatraktárak, a SaaS-alkalmazások, a fájlok és a web között?

A Computer képes kombinálni az engedélyezett forrásokból származó információkat egyetlen munkafolyamatban. Ez nem szünteti meg a megbízható entitásfeloldás szükségességét. A pontos jelentéskészítés érdekében tartsa fenn a kanonikus ügyfél-, termék- és fiókazonosítókat a forrásrendszerben, dokumentálja a jóváhagyott kereszt-hivatkozásokat, és határozza meg az igazság forrását minden egyes metrikához.

Pontosság és auditálhatóság

Hogyan kell az adatelemző csapatnak érvényesítenie a generált SQL-t és válaszokat?

A Computer áttekinthető SQL-t generál. Az adatelemző csapatoknak ellenőrizniük kell az SQL-t, össze kell hasonlítaniuk a lényegi kimeneteket a megbízható jelentésekkel, tesztelniük kell a peremfeltételeket, és ki kell javítaniuk a hiányzó üzleti kontextust az adattérképen.

Ha a rendszerek nem értenek egyet, hogyan választják ki a hiteles metrikát?

Az adatelemző csapatnak egyértelművé kell tennie a döntést. Az adminisztrátorok szerkeszthetik az adattérképet, hogy a jóváhagyott definíció legyen az éles alapigazság, és a tartós üzleti definíciók elhelyezhetők a kiegészítő kontextusban. Az ellentmondásos felhasználói javításokat emberi felülvizsgálatra irányítják át, ahelyett, hogy automatikusan feloldanák azokat. Minden lényegi metrikához dokumentálja a kanonikus forrást, részletességet, a szükséges szűrőket, a felelőst és az ismert alternatívákat.

Milyen auditnapló érhető el?

A Perplexity auditnaplók rögzítik az eseményeket a felhasználói bevitel, az ügynök műveletei, a befejezés, a hibák és az adminisztrációs változások terén. Az olyan adatraktárak, mint a Snowflake és a Databricks, megőrzik a hiteles adatraktár oldali lekérdezési és identitásrekordokat.

Minden egyes válasz pontosan reprodukálható egy könyvvizsgáló számára?

A pontos determinisztikus visszajátszás nem nyilvánosan dokumentált vagy garantált. Az auditnaplók, a szál, az áttekinthető SQL, az adattérkép verzióelőzményei és az adatraktár-rekordok segíthetnek egy futtatás rekonstruálásában, de nincs dokumentált azonosító, amely minden választ az adatok, a jogosultságok, az adattérkép és a modell futtatókörnyezetének változatlan pillanataihoz kötne. A szigorú reprodukálhatósági követelményekkel rendelkező szervezeteknek meg kell őrizniük saját verziózott bizonyítékjegyzéküket.

Biztonság és megfelelőség

Hol maradnak fenn az adatok, és felhasználják-e őket a modell betanítására?

A vállalati adatok nem kerülnek felhasználásra a Perplexity modellek betanítására vagy finomhangolására. A Computer feladatok elszigetelt sandbox környezetekben futnak, és a hitelesítő adatok a sandboxszal együtt megsemmisülnek. A munkamenet-műtermékek és az adatraktár lekérdezési előzményei külön vannak szabályozva. A csatolt munkamenet-fájlok hét nap után törlődnek. További konfigurálható megőrzési beállítások állnak rendelkezésre a vállalati szervezetek számára.

Munkamenet-erőforrások

Készen állsz a következő lépésre?

Fedezd fel, hogyan alakíthatja át a Perplexity a munkádat