API Agent : un lieu unique pour créer avec les LLM, le Web et les Agents

L'API Agent de Perplexity est un point de terminaison programmable unique pour la recherche, l'URL fetching et l'exécution de code.

Perplexity développe l'infrastructure pour le travail qui dépend des modèles linguistiques, du web public et des agents exécutés sur les deux. L'API Agent est le moyen pour les développeurs de se connecter à cette infrastructure. Il s'agit d'un point de terminaison programmable unique pour la recherche sur le web, la récupération d'URL, l'exécution de code, les connexions MCP, ainsi que la recherche financière et de personnes. Pour chaque requête, ces capacités sont composées à la demande dans un pipeline de récupération.

Aujourd'hui, nous faisons passer tous les clients Sonar à un préréglage de l'API Agent qui obtient de meilleurs scores lors des tests de référence à un coût inférieur. Sonar restera disponible pendant 45 jours avant que l'API Agent ne devienne l'unique interface pour ce travail. Les clients ayant des engagements contractuels en cours avec Sonar sont couverts jusqu'à la fin de leur période en cours.

Les équipes l'utilisent pour créer des agents de recherche, des expériences de réponse intégrées aux produits et des automatisations de flux de travail qui nécessitent des informations actuelles et citées, sans avoir à assembler un fournisseur de recherche, un hôte de modèle, un environnement d'exécution d'outils et une couche d'orchestration séparés.

Une surface programmable unique

Avant l'API Agent, Sonar exposait ses fonctionnalités via un ensemble fixe de modèles : Sonar, Sonar Pro, Sonar Reasoning Pro et Sonar Deep Research. Choisir un modèle signifiait choisir un ensemble statique de profondeur de raisonnement, de comportement de recherche et de coût, et figer cet ensemble dans le code de production. Chaque niveau constituait une décision de produit distincte plutôt qu'une configuration d'une pile partagée.

L'API Agent réduit ces niveaux en une seule surface programmable. Six préréglages (fast, low, medium, high, xhigh et wide-research) reposent sur la même infrastructure et l'exposent à différents points de la courbe de qualité et de coût. Chaque préréglage est une configuration transparente et préconfigurée : un modèle associé à une invite système, une configuration d'outils, un effort de raisonnement et des budgets de jetons ajustés en fonction de charges de travail réelles.

Les préréglages sont réajustés à chaque sortie de modèle de pointe, de sorte qu'un appel à low aujourd'hui et le même appel dans six mois reflètent tous deux l'état de l'art actuel à un coût prévisible. Chaque paramètre reste modifiable.

Les niveaux de Sonar correspondent directement aux préréglages : sonar à fast, sonar-pro à low, sonar-reasoning-pro à medium, et sonar-deep-research à high. Le préréglage xhigh va au-delà de la recherche approfondie pour les travaux d'agents ouverts.

Search as Code, la couche sous-jacente

L'API Agent inclut la recherche sur le web, la récupération d'URL, un bac à sable de code, des connexions au serveur MCP, la recherche financière et la recherche de personnes. Les préréglages configurent ces outils par défaut, et chaque outil est disponible pour toute configuration d'agent personnalisée.

Ces outils reposent sur Search as Code, l'architecture qui sous-tend la pile de recherche de Perplexity. Au lieu d'acheminer la récupération via une interface fixe unique, Search as Code expose des primitives de recherche qu'un modèle compose à la demande dans un pipeline de récupération pour chaque requête. C'est ce qui permet aux préréglages haut de gamme d'exécuter des milliers d'étapes de récupération en un seul appel.

C'est également ce qui permet aux préréglages de toute la gamme de fournir de meilleures réponses par dollar qu'un pipeline traditionnel associant recherche et modèle. Les développeurs obtiennent les mêmes primitives sur lesquelles sont construits les propres produits de Perplexity, dans la même API.

Une meilleure qualité par dollar sur l'ensemble des benchmarks

Nous avons évalué les préréglages de l'API Agent et les modèles Sonar sur des charges de travail identiques à travers trois benchmarks : BrowseComp, qui mesure la navigation par agent sur des questions nécessitant l'enchaînement de nombreuses recherches ; DeepSearchQA, qui mesure la qualité des réponses sur des questions de recherche approfondie ; et WideSearch, qui mesure la complétude avec laquelle une exécution rassemble et remplit des résultats structurés.

API Agent vs Sonar

Le préréglage low offre une amélioration d'environ 7x sur BrowseComp par rapport à Sonar Pro pour un coût d'environ 0,05 $ par requête. Les préréglages de l'API Agent peuvent égaler Sonar Deep Research à une fraction du coût.

Prochaines étapes pour les utilisateurs de Sonar

Si les utilisateurs appellent Sonar aujourd'hui, ils devront rediriger leur intégration vers l'API Agent avant la date de fin de service. Il s'agit d'un changement mineur : le choix du modèle existant correspond à un préréglage équivalent, et les formats de requête et de réponse sont légèrement différents.

La plupart des équipes effectuent cette opération en quelques minutes. Notre Skill d'agent de codage peut appliquer le changement sur place, et le guide de migration sur docs.perplexity.ai détaille la correspondance champ par champ pour les ingénieurs qui le font manuellement.

Si rien ne change d'ici la date de fin de service, les appels à Sonar cesseront de fonctionner. C'est pourquoi nous recommandons d'effectuer la migration au début de la période de grâce.

Disponibilité continue

Les points de terminaison de Sonar restent entièrement disponibles aujourd'hui. Le 27 septembre 2026, l'API Agent deviendra la principale surface pour ce travail, et les niveaux de Sonar seront retirés à la même date. Chaque niveau existant correspond à un préréglage offrant de meilleurs scores de référence à moindre coût, de sorte que le transfert consolide les charges de travail sur une seule pile programmable sans rien concéder. Les documents de migration, les détails des préréglages et le guide de correspondance champ par champ se trouvent sur docs.perplexity.ai.