Agent API: Un motor de execución xestionado para fluxos de traballo baseados en axentes
Hoxe lanzamos a Perplexity Agent API, un motor de execución xestionado para construír fluxos de traballo baseados en axentes con busca integrada, execución de ferramentas e orquestración de varios modelos.

Hoxe lanzamos a Perplexity Agent API, un motor de execución xestionado para construír fluxos de traballo baseados en axentes con busca integrada, execución de ferramentas e orquestración de varios modelos.
Substitúe un enrutador de modelos, unha capa de busca, un provedor de incrustacións, un servizo de contorno illado e unha pila de monitorización por un único punto de integración.
O bucle de axentes como modelo de computación
Unha CPU convencional executa un ciclo determinista: recupera unha instrución, descodifícaa, execútaa e almacena o resultado. O contador do programa avanza. O procesador nunca decide o que facer.
A Agent API implementa un modelo de computación diferente. O procesador é un modelo lingüístico de vangarda. Recibe un obxectivo e determina como acadalo. Descompoñen ese obxectivo nun plan, selecciona que ferramentas utilizar do seu conxunto dispoñible, execútase, observa os resultados, avalía se se cumpre o obxectivo e fai iteracións. A xanela de contexto serve como rexistros. O razoamento e a orquestración serven como planificador.
Imos considerar a preparación dunha chamada de vendas cun cliente potencial co que falaches un par de veces. Envías unha única solicitude á Agent API con tres ferramentas: unha para buscar no teu CRM interno, web_search e fetch_url. O modelo chama primeiro á túa ferramenta de CRM, recuperando o contexto de conversas anteriores. A despois chama a web_search para atopar noticias recentes e intelixencia competitiva, devolvendo varias páxinas relevantes. Decide que dúas destas páxinas merecen unha lectura máis profunda e chama a fetch_url en cada unha delas. En tres pasos, o modelo reuniu o historial interno, un amplo contexto web e detalles dunha páxina completa nunha única resposta fundamentada. Ese é o bucle de axentes.
Orquestración do bucle de axentes completo
É importante distinguir a Agent API dos servizos de enrutamento de modelos. A Agent API é un motor de execución xestionado que orquestra o bucle de axentes completo: recuperación, execución de ferramentas, razoamento e alternativas de varios modelos, ademais de calquera ferramenta personalizada á que lle des acceso. Substitúe un enrutador de modelos, unha capa de busca, un provedor de incrustacións, un servizo de contorno illado e unha pila de monitorización por un único punto de acceso, conta e clave de API.
A API é independente do modelo en todos os provedores de modelos de vangarda. Para aplicacións de alta dispoñibilidade, a API admite cadeas de alternativas de modelos: especificas varios modelos e a API proba automaticamente o seguinte se un non está dispoñible. Isto garante unha dispoñibilidade próxima ao 100%.
Ferramentas potentes integradas
Hai dúas ferramentas integradas dispoñibles: web_search e fetch_url. web_search admite o filtrado de dominios (lista de permitidos e lista negra, ata 20 dominios), filtrado de recencia, filtrado por intervalo de datas, filtrado de idiomas e orzamentos de contido configurables por páxina. fetch_url recupera e extrae o contido completo da páxina de URL específicas.
Mais aló das ferramentas integradas, as funcións personalizadas permiten aos desenvolvedores conectar o axente aos seus propios backends, bases de datos e API.
Predefinicións de modelos de vangarda optimizadas continuamente
Construír unha configuración de axentes eficaz dende cero require escoller o modelo correcto, calibrar a profundidade do razoamento, seleccionar ferramentas e axustar os orzamentos de tokens. Perplexity fai isto de forma continua para os seus propios produtos, co apoio dun equipo de avaliación interno que compara as configuracións con cargas de traballo reais.
As predefinicións comparten esa experiencia. Cada predefinición é unha configuración totalmente transparente e preconfigurada optimizada para un caso de uso específico: consultas de feitos rápidas, investigación equilibrada, análise profunda de múltiples fontes e investigación de grao institucional. Publicamos o aviso do sistema recomendado, as ferramentas e o perfil de custos para cada unha. A medida que evoluciona o panorama dos modelos, actualizamos as configuracións subxacentes para que a predefinición reflicta sempre o estado da arte actual a un custo previsible. Todos os parámetros predefinidos pódense anular: os desenvolvedores poden usar unha predefinición como punto de partida e axustar o modelo, as ferramentas, o recuso de pasos ou os orzamentos de tokens nunha única solicitude.
Deep Research 2.0, dispoñible a través da predefinición advanced-deep-research, é o mesmo motor de razoamento de varios pasos que alimenta o produto para consumidores de Perplexity. Realiza decenas de buscas por consulta, le centos de documentos de orixe e refina iterativamente a súa análise. O rendemento en DRACO, ResearchRubrics de Scale AI e DeepSearchQA de Google DeepMind detállase na nosa publicación sobre a benchmark de DRACO.
A Agent API xa está dispoñible. A documentación e as guías de inicio rápido están en docs.perplexity.ai