Agent API: Um local para criar com LLMs, a Web e Agentes

A Agent API da Perplexity é um endpoint programável para busca na web, recuperação de URLs, execução de código, MCP, busca de finanças e pessoas, com predefinições ajustáveis.

A Perplexity está criando a infraestrutura para trabalhos que dependem de modelos de linguagem, da web pública e de agentes que operam em ambos. A Agent API é a forma como os desenvolvedores se conectam a essa infraestrutura. Trata-se de um único endpoint programável para busca na web, recuperação de URLs, execução de código, conexões MCP e busca de finanças e pessoas. Para cada solicitação, esses recursos são combinados sob demanda em um pipeline de recuperação.

Hoje estamos atualizando todos os clientes do Sonar para uma predefinição da Agent API que obtém pontuações mais altas em benchmarks com menor custo. O Sonar continuará disponível por 45 dias antes que a Agent API se torne a única superfície para esse trabalho. Clientes com compromissos contratuais existentes com o Sonar estão cobertos até o fim de seu termo atual.

As equipes a utilizam para criar agentes de pesquisa, experiências de resposta integradas aos produtos e automações de fluxos de trabalho que precisam de informações atuais e citadas, sem a necessidade de integrar separadamente um provedor de busca, um host de modelo, um tempo de execução de ferramentas e uma camada de orquestração.

Uma superfície programável

Antes da Agent API, o Sonar expunha recursos por meio de um conjunto fixo de modelos: Sonar, Sonar Pro, Sonar Reasoning Pro e Sonar Deep Research. Escolher um modelo significava escolher um pacote estático de profundidade de raciocínio, comportamento de busca e custo, e fixar esse pacote no código de produção. Cada camada era uma decisão de produto separada, em vez de uma configuração de uma pilha compartilhada.

A Agent API consolida essas camadas em uma única superfície programável. Seis predefinições — fast, low, medium, high, xhigh e wide-research — operam na mesma infraestrutura e a expõem em diferentes pontos da curva de qualidade e custo. Cada predefinição é uma configuração transparente e pré-configurada: um modelo combinado com um prompt de sistema, configuração de ferramentas, esforço de raciocínio e orçamentos de tokens ajustados com base em cargas de trabalho reais.

As predefinições são reajustadas a cada lançamento de modelo de ponta, de modo que uma chamada para low hoje e a mesma chamada daqui a seis meses refletirão o estado da arte atual a um custo previsível. Todos os parâmetros continuam configuráveis para substituição.

As camadas do Sonar mapeiam diretamente para as predefinições: sonar para fast, sonar-pro para low, sonar-reasoning-pro para medium e sonar-deep-research para high. A predefinição xhigh vai além da Pesquisa profunda para trabalhos com agentes em aberto.

Search as Code, a camada subjacente

A Agent API inclui busca na web, recuperação de URLs, um sandbox de código, conexões de servidor MCP, busca de finanças e busca de pessoas. As predefinições configuram essas ferramentas por padrão, e cada ferramenta está disponível para qualquer configuração de agente personalizada.

Essas ferramentas operam sobre o Search as Code, a arquitetura por trás da pilha de busca da Perplexity. Em vez de direcionar a recuperação por meio de uma única interface fixa, o Search as Code expõe primitivas de busca que um modelo compõe sob demanda em um pipeline de recuperação para cada solicitação. É isso que permite que as predefinições de ponta executem milhares de etapas de recuperação em uma única chamada.

É também isso que permite que as predefinições em toda a gama ofereçam melhores respostas por dólar do que um pipeline tradicional de busca com modelo. Os desenvolvedores obtêm as mesmas primitivas nas quais os próprios produtos da Perplexity são construídos, na mesma API.

Maior qualidade por dólar em benchmarks

Avaliamos as predefinições da Agent API e os modelos do Sonar em cargas de trabalho idênticas em três benchmarks: BrowseComp, que mede a navegação de agentes em perguntas que exigem o encadeamento de várias buscas; DeepSearchQA, que mede a qualidade das respostas em perguntas de busca profunda; e WideSearch, que mede a abrangência com que uma execução coleta e preenche resultados estruturados.

Agent API vs Sonar

A predefinição low oferece uma melhoria de aproximadamente 7x no BrowseComp em comparação com o Sonar Pro a um custo de cerca de US$ 0,05 por consulta. As predefinições da Agent API conseguem equiparar-se ao Sonar Deep Research a uma fração do custo.

Próximas etapas para os usuários do Sonar

Se os usuários chamarem o Sonar hoje, precisarão apontar sua integração para a Agent API antes da data de descontinuação. Trata-se de uma alteração simples: a escolha de modelo existente mapeia para uma predefinição correspondente, e os formatos de solicitação e resposta são ligeiramente diferentes.

A maioria das equipes conclui isso em minutos. Nossa skill de agente de codificação pode aplicar a alteração no local, e o guia de migração em docs.perplexity.ai detalha o mapeamento campo por campo para os engenheiros que o fizerem manualmente.

Se nada for alterado até a data de descontinuação, as chamadas do Sonar deixarão de funcionar; portanto, recomendamos a migração antecipada durante o período de carência.

Disponibilidade contínua

Os endpoints do Sonar permanecem totalmente disponíveis hoje. Em 27 de setembro de 2026, a Agent API se tornará a superfície principal para esse trabalho, e as camadas do Sonar serão descontinuadas na mesma data. Cada camada existente é mapeada para uma predefinição que pontua melhor em benchmarks com menor custo, de modo que a transição consolida as cargas de trabalho em uma única pilha programável sem perda de recursos. A documentação de migração, os detalhes das predefinições e o guia de mapeamento campo por campo estão disponíveis em docs.perplexity.ai.