Agent API: Spravované běhové prostředí pro agentní pracovní postupy
Dnes vydáváme Perplexity Agent API, spravované běhové prostředí pro vytváření agentních pracovních postupů s integrovaným vyhledáváním, spouštěním nástrojů a orchestrací více modelů.

Dnes vydáváme Perplexity Agent API, spravované běhové prostředí pro vytváření agentních pracovních postupů s integrovaným vyhledáváním, spouštěním nástrojů a orchestrací více modelů.
Nahrazuje router modelů, vrstvu vyhledávání, poskytovatele vnoření (embeddings), službu sandbox a monitorovací zásobník jediným integračním bodem.
Agentní smyčka jako výpočetní model
Konvenční procesor CPU provádí deterministický cyklus: načte instrukci, dekóduje ji, provede ji, uloží výsledek. Ukazatel programu se posune vpřed. Procesor nikdy nerozhoduje o tom, co má dělat.
Agent API implementuje jiný výpočetní model. Procesorem je špičkový jazykový model. Přijímá cíl a určuje, jak jej dosáhnout. Tento cíl rozkládá na plán, vybírá nástroje, které má použít z dostupné sady nástrojů, provádí akce, sleduje výsledky, vyhodnocuje, zda byl cíl splněn, a opakuje proces. Kontextové okno slouží jako registry. Argumentace a orchestrace slouží jako plánovač.
Představte si přípravu na obchodní hovor s potenciálním zákazníkem, se kterým jste již několikrát mluvili. Odešlete jediný požadavek na Agent API se třemi nástroji: jedním pro vyhledávání ve vašem interním CRM, web_search a fetch_url. Model nejprve zavolá váš nástroj CRM a získá kontext z minulých konverzací. Poté zavolá web_search, aby našel nejnovější zprávy a konkurenční analýzu, a vrátí několik relevantních stránek. Rozhodne, že dvě z těchto stránek vyžadují hlubší přečtení, a u každé z nich zavolá fetch_url. Vést třech krocích model shromáždil interní historii, široký kontext z webu a podrobnosti o celé stránce do jediné, podložené odpovědi. To je agentní smyčka.
Orchestrace celé agentní smyčky
Je důležité odlišit Agent API od služeb pro směrování modelů. Agent API je spravované běhové prostředí, které orchestruje celou agentní smyčku: získávání dat, spouštění nástrojů, uvažování, záložní řešení s více modely a jakékoli vlastní nástroje, ke kterým mu poskytnete přístup. Nahrazuje router modelů, vrstvu vyhledávání, poskytovatele vnoření, službu sandbox a monitorovací zásobník jediným koncovým bodem, účtem a klíčem API.
API je nezávislé na modelech u všech poskytovatelů špičkových modelů. Pro vysoce dostupné aplikace podporuje API řetězce záložních modelů: zadáte více modelů a API automaticky vyzkouší další, pokud je jeden nedostupný. To zajišťuje téměř 100% dostupnost.
Výkonné, vestavěné nástroje
K dispozici jsou dva vestavěné nástroje: web_search a fetch_url. web_search podporuje filtrování podle domén (seznam povolených a zakázaných domén, až 20 domén), filtrování podle stáří, filtrování podle časového rozsahu, filtrování podle jazyka a konfigurovatelné rozpočty na obsah pro každou stránku. fetch_url načítá a extrahuje obsah celé stránky z konkrétních adres URL.
Kromě vestavěných nástrojů umožňují vlastní funkce vývojářům připojit agenta k vlastním backendům, databázím a rozhraním API.
Nepřetržitě optimalizované předvolby špičkových modelů
Sestavení efektivní konfigurace agenta od základu vyžaduje výběr správného modelu, kalibraci hloubky uvažování, výběr nástrojů a vyladění rozpočtů tokenů. Perplexity to neustále provádí pro své vlastní produkty za podpory interního vyhodnocovacího týmu, který provádí benchmarky konfigurací oproti skutečným pracovním zátěžím.
Předvolby tuto odbornost sdílejí. Každá předvolba je plně transparentní, předem nakonfigurované nastavení optimalizované pro konkrétní případ použití: rychlé vyhledávání faktů, vyvážený průzkum, hloubková analýza z více zdrojů a výzkum na institucionální úrovni. Pro každou z nich zveřejňujeme doporučenou systémovou výzvu, nástroje a profil nákladů. S tím, jak se prostředí modelů vyvíjí, aktualizujeme základní konfigurace, aby předvolba vždy odrážela aktuální stav techniky za předvídatelné náklady. Všechny parametry předvoleb lze přepsat: vývojáři mohou použít předvolbu jako výchozí bod a v jediném požadavku upravit model, nástroje, počet kroků nebo rozpočty tokenů.
Deep Research 2.0, dostupný prostřednictvím předvolby advanced-deep-research, je stejný vícestupňový uvažovací engine, který pohání spotřebitelský produkt společnosti Perplexity. Provádí desítky vyhledávání na jeden dotaz, čte stovky zdrojových dokumentů a iterativně upřesňuje svou analýzu. Výkon na systémech DRACO, ResearchRubrics od Scale AI a DeepSearchQA od Google DeepMind je podrobně popsán v našem příspěvku k benchmarku DRACO.
Agent API je k dispozici od dnešního dne. Dokumentace a příručky pro rychlý start se nacházejí na adrese docs.perplexity.ai