API Agent: un unico luogo per sviluppare con LLM, Web e Agenti

L'API Agent di Perplexity è un singolo endpoint programmabile per ricerca web, recupero URL, esecuzione codice, MCP e ricerca finanziaria e di persone, con preset regolabili.

Perplexity sta creando l'infrastruttura per il lavoro che dipende da modelli linguistici, dal web pubblico e da agenti operativi su entrambi. L'API Agent è il modo in cui gli sviluppatori si collegano a tale infrastruttura. È un singolo endpoint programmabile per la ricerca sul web, il recupero di URL, l'esecuzione di codice, le connessioni MCP e la ricerca finanziaria e di persone. Per ogni richiesta, queste funzionalità vengono composte su richiesta in una pipeline di recupero.

Oggi stiamo aggiornando tutti i clienti di Sonar a un preset dell'API Agent che ottiene punteggi più alti nei benchmark a costi inferiori. Sonar rimarrà disponibile per 45 giorni prima che l'API Agent diventi l'unica superficie per questo lavoro. I clienti con impegni contrattuali esistenti per Sonar sono coperti fino alla fine del loro periodo di validità corrente.

I team la utilizzano per creare agenti di ricerca, esperienze di risposta integrate nei prodotti e automazioni del flusso di lavoro che richiedono informazioni aggiornate e citate, senza dover combinare un provider di ricerca, un host di modelli, un runtime di strumenti e un livello di orchestrazione separati.

Un'unica superficie programmabile

Prima dell'API Agent, Sonar offriva funzionalità attraverso un set fisso di modelli: Sonar, Sonar Pro, Sonar Reasoning Pro e Sonar Deep Research. Scegliere un modello significava scegliere un pacchetto statico di profondità di ragionamento, comportamento di ricerca e costo, e bloccare quel pacchetto nel codice di produzione. Ciascun livello rappresentava una decisione di prodotto separata anziché la configurazione di uno stack condiviso.

L'API Agent riduce questi livelli a un'unica superficie programmabile. Sei preset (fast, low, medium, high, xhigh e wide-research) si trovano sulla stessa infrastruttura e la espongono a diversi punti della curva di qualità e costo. Ciascun preset è una configurazione trasparente e predefinita: un modello abbinato a un prompt di sistema, a una configurazione degli strumenti, a un livello di ragionamento e a budget di token ottimizzati in base a carichi di lavoro reali.

I preset vengono ricalibrati a ogni rilascio di un modello di frontiera, in modo che una chiamata a low oggi e la stessa chiamata tra sei mesi riflettano entrambe lo stato dell'arte attuale a un costo prevedibile. Ogni parametro rimane modificabile.

I livelli di Sonar si mappano direttamente sui preset: sonar su fast, sonar-pro su low, sonar-reasoning-pro su medium e sonar-deep-research su high. Il preset xhigh si estende oltre la Ricerca approfondita per lavori con agenti aperti.

Search as Code, il livello sottostante

L'API Agent include ricerca sul web, recupero di URL, una sandbox di codice, connessioni a server MCP, ricerca finanziaria e ricerca di persone. I preset configurano questi strumenti per impostazione predefinita e ogni strumento è disponibile per qualsiasi configurazione di agente personalizzato.

Questi strumenti si basano su Search as Code, l'architettura alla base dello stack di ricerca di Perplexity. Invece di instradare il recupero attraverso una singola interfaccia fissa, Search as Code espone primitive di ricerca che un modello compone su richiesta in una pipeline di recupero per ciascuna richiesta. È ciò che consente ai preset di fascia alta di eseguire migliaia di passaggi di recupero in una singola chiamata.

È anche ciò che consente ai preset dell'intera gamma di fornire risposte migliori per dollaro rispetto a una tradizionale pipeline di ricerca più modello. Gli sviluppatori ottengono le stesse primitive su cui sono basati i prodotti di Perplexity, nella stessa API.

Qualità superiore per dollaro nei benchmark

Abbiamo valutato i preset dell'API Agent e i modelli Sonar su carichi di lavoro identici in tre benchmark: BrowseComp, che misura la navigazione degli agenti su domande che richiedono l' concatenazione di molte ricerche; DeepSearchQA, che misura la qualità delle risposte su domande di ricerca approfondita; e WideSearch, che misura la completezza con cui un'esecuzione raccoglie e compila risultati strutturati.

API Agent vs Sonar

Il preset low offre un miglioramento di circa 7 volte su BrowseComp rispetto a Sonar Pro a circa 0,05 $ per query. I preset dell'API Agent possono eguagliare Sonar Deep Research a una frazione del costo.

Prossimi passi per gli utenti di Sonar

Se gli utenti utilizzano Sonar oggi, dovranno puntare la propria integrazione sull'API Agent prima della data di ritiro. Si tratta di un piccolo cambiamento: la scelta del modello esistente si mappa su un preset corrispondente e i formati di richiesta e risposta sono leggermente diversi.

La maggior parte dei team completa questa operazione in pochi minuti. La nostra skill per agenti di codifica può applicare la modifica sul posto e la guida alla migrazione su docs.perplexity.ai illustra la mappatura campo per campo per gli ingegneri che lo fanno manualmente.

Se nulla cambia entro la data di ritiro, le chiamate a Sonar smetteranno di funzionare, quindi consigliamo di effettuare la migrazione in anticipo durante il periodo di grazia.

Disponibilità continuativa

Gli endpoint di Sonar rimangono pienamente disponibili oggi. Il 27 settembre 2026, l'API Agent diventerà la superficie principale per questo lavoro e i livelli di Sonar verranno ritirati alla stessa data. Ogni livello esistente si mappa su un preset che ottiene risultati migliori nei benchmark a un costo inferiore, quindi il passaggio consolida i carichi di lavoro su un unico stack programmabile senza rinunciare a nulla. La documentazione di migrazione, i dettagli dei preset e la guida alla mappatura campo per campo sono disponibili su docs.perplexity.ai.