Agent API: pārvaldīta izpildlaide aģentu darbplūsmām

Šodien mēs izlaižam Perplexity Agent API — pārvaldītu izpildlaidi aģentu darbplūsmu veidošanai ar integrētu meklēšanu, rīku izpildi un vairāku modeļu…

Šodien mēs izlaižam Perplexity Agent API — pārvaldītu izpildlaidi aģentu darbplūsmu veidošanai ar integrētu meklēšanu, rīku izpildi un vairāku modeļu orķestrēšanu.

Tā aizstāj modeļu maršrutētāju, meklēšanas slāni, iegulšanas nodrošinātāju, smilšu kastes pakalpojumu un uzraudzības steku ar vienu integrācijas punktu.

Aģenta cikls kā skaitļošanas modelis

Parasts centrālais procesors izpilda deterministisku ciklu: ielādē instrukciju, dekodē to, izpilda, saglabā rezultātu. Programmas skaitītājs virzās uz priekšu. Procesors nekad nelemj, ko darīt.

Agent API īsteno citu skaitļošanas modeli. Procesors ir jaunākās paaudzes valodas modelis. Tas saņem mērķi un nosaka, kā to sasniegt. Tas sadala šo mērķi plānā, izvēlas izmantojamos rīkus no pieejamo rīku kopas, izpilda, novēro rezultātus, izvērtē, vai mērķis ir sasniegts, un veic iterācijas. Konteksta logs kalpo kā reģistri. Argumentācija un orķestrēšana kalpo kā plānotājs.

Apsveriet sagatavošanos pārdošanas zvanam ar potenciālo klientu, ar kuru esat runājis pāris reizes. Jūs nosūtāt vienu pieprasījumu uz Agent API ar trim rīkiem: vienu iekšējās CRM meklēšanai, web_search un fetch_url. Modelis vispirms izsauc jūsu CRM rīku, izgūstot kontekstu no iepriekšējām sarunām. Pēc tam tas izsauc web_search, lai atrastu jaunākās ziņas un konkurences izlūkdatus, atgriežot vairākas attiecīgas lapas. Tas izlemj, ka divām no šīm lapām ir nepieciešama dziļāka lasīšana, un katrai izsauc fetch_url. Trīs soļos modelis ir apvienojis iekšējo vēsturi, plašu tīmekļa kontekstu un pilnas lapas informāciju vienā pamatotā atbildē. Tas ir aģenta cikls.

Pilna aģenta cikla orķestrēšana

Ir svarīgi atšķirt Agent API no modeļu maršrutēšanas pakalpojumiem. Agent API ir pārvaldīta izpildlaide, kas orķestrē pilnu aģenta ciklu: izgūšanu, rīku izpildi, argumentāciju, vairāku modeļu alternatīvo ceļu un visus pielāgotos rīkus, kuriem jūs piešķirat piekļuvi. Tā aizstāj modeļu maršrutētāju, meklēšanas slāni, iegulšanas nodrošinātāju, smilšu kastes pakalpojumu un uzraudzības steku ar vienu galapunktu, kontu un API atslēgu.

API ir neatkarīga no modeļiem un darbojas ar visiem jaunākās paaudzes modeļu nodrošinātājiem. Augstas pieejamības lietojumprogrammām API atbalsta modeļu rezerves ķēdes: norādiet vairākus modeļus, un API automātiski mēģinās izmantot nākamo, ja viens nav pieejams. Tas nodrošina gandrīz 100% pieejamību.

Jaudīgi, iebūvēti rīki

Ir pieejami divi iebūvēti rīki: web_search un fetch_url. web_search atbalsta domēnu filtrēšanu (atļauto un bloķēto sarakstu, līdz 20 domēniem), jaunuma filtrēšanu, datumu diapazona filtrēšanu, valodas filtrēšanu un konfigurējamus satura budžetus katrai lapai. fetch_url izgūst un ekstrahē pilnas lapas saturu no konkrētiem vietrāžiem URL.

Papildus iebūvētajiem rīkiem pielāgotas funkcijas ļauj izstrādātājiem savienot aģentu ar savām aizmugursistēmām, datu bāzēm un API.

Nepārtraukti optimizēti jaunākās paaudzes modeļu sākotnējie iestatījumi

Efektīvas aģenta konfigurācijas izveide no nulles prasa pareizā modeļa izvēli, argumentācijas dziļuma kalibrēšanu, rīku izvēli un marķieru budžetu pielāgošanu. Perplexity to nepārtraukti dara saviem produktiem, ko atbalsta iekšējā novērtēšanas komanda, kura salīdzina konfigurācijas ar reālām darba slodzēm.

Sākotnējie iestatījumi dalās ar šo pieredzi. Katrs iestatījums ir pilnīgi pārredzama, iepriekš konfigurēta iestatīšana, kas optimizēta konkrētam lietošanas gadījumam: ātrai faktoloģiskai uzmeklēšanai, līdzsvarotai izpētei, padziļinātai vairāku avotu analīzei un institucionāla līmeņa izpētei. Mēs publicējam ieteikto sistēmas uzvedni, rīkus un izmaksu profilu katram gadījumam. Attīstoties modeļu pasaulei, mēs atjauninām pamata konfigurācijas, lai iestatījums vienmēr atspoguļotu pašreizējo tehnikas līmeni par paredzamām izmaksām. Visi iestatījuma parametri ir ignorējami: izstrādātāji var izmantot iestatījumu kā sākumpunktu un pielāgot modeli, rīkus, soļu skaitu vai marķieru budžetus vienā pieprasījumā.

Deep Research 2.0, kas pieejams, izmantojot advanced-deep-research iestatījumu, ir tas pats vairāku soļu argumentācijas dzinējs, kas darbina Perplexity patērētāju produktu. Tas veic desmitiem meklējumu uz vienu vaicājumu, lasa simtiem avota dokumentu un iteratīvi pilnveido savu analīzi. Veiktspēja DRACO, Scale AI ResearchRubrics un Google DeepMind DeepSearchQA ir detalizēti aprakstīta mūsu DRACO benchmarks rakstā.

Agent API ir pieejams šodien. Dokumentācija un ātrā darba sākšanas ceļveži atrodas vietnē docs.perplexity.ai