Agent API: Un lugar único para desarrollar con LLMs, la Web y Agentes

La Agent API de Perplexity es un único punto de acceso programable para búsquedas web, recuperación de URL, ejecución de código, MCP y búsquedas de finanzas y personas, con preajustes configurables.

Perplexity está creando la infraestructura para el trabajo que depende de modelos de lenguaje, la web pública y agentes que operan en ambos entornos. La Agent API es la forma en que los desarrolladores se conectan a esa infraestructura. Es un único punto de acceso programable para búsquedas web, recuperación de URL, ejecución de código, conexiones MCP y búsquedas de finanzas y personas. Para cada solicitud, estas capacidades se combinan bajo demanda en una canalización de recuperación.

Hoy estamos actualizando a todos los clientes de Sonar a un preajuste de la Agent API que obtiene mejores resultados en las pruebas de rendimiento a un menor costo. Sonar seguirá estando disponible durante 45 días antes de que la Agent API se convierta en la única interfaz para este trabajo. Los clientes con compromisos contractuales vigentes con Sonar estarán cubiertos hasta el final de su período actual.

Los equipos la utilizan para crear agentes de investigación, experiencias de respuesta integradas en productos y automatizaciones de flujos de trabajo que requieren información actualizada y citada, sin necesidad de combinar un proveedor de búsqueda independiente, un alojamiento de modelos, un entorno de ejecución de herramientas y una capa de orquestación.

Una superficie programable

Antes de la Agent API, Sonar ofrecía capacidades a través de un conjunto fijo de modelos: Sonar, Sonar Pro, Sonar Reasoning Pro y Sonar Deep Research. Elegir un modelo significaba elegir un paquete estático de profundidad de razonamiento, comportamiento de búsqueda y costo, y fijar ese paquete en el código de producción. Cada nivel era una decisión de producto independiente en lugar de una configuración de una infraestructura compartida.

La Agent API reduce esos niveles a una sola superficie programable. Seis preajustes —fast, low, medium, high, xhigh y wide-research— se basan en la misma infraestructura y la exponen en diferentes puntos de la curva de calidad y costo. Cada preajuste es una configuración transparente y preconfigurada: un modelo combinado con una instrucción del sistema, una configuración de herramientas, un esfuerzo de razonamiento y presupuestos de tokens ajustados a cargas de trabajo reales.

Los preajustes se vuelven a ajustar con cada lanzamiento de un modelo de vanguardia, de modo que una llamada a low hoy y la misma llamada dentro de seis meses reflejan el estado actual de la tecnología a un costo predecible. Todos los parámetros siguen siendo modificables.

Los niveles de Sonar se corresponden directamente con los preajustes: sonar con fast, sonar-pro con low, sonar-reasoning-pro con medium y sonar-deep-research con high. El preajuste xhigh va más allá de Investigación profunda para trabajos con agentes abiertos.

Search as Code, la capa subyacente

La Agent API incluye búsqueda web, recuperación de URL, un entorno aislado de código, conexiones a servidores MCP, búsqueda financiera y búsqueda de personas. Los preajustes configuran estas herramientas de forma predeterminada, y cada herramienta está disponible para cualquier configuración de agente personalizada.

Estas herramientas se basan en Search as Code, la arquitectura detrás de la infraestructura de búsqueda de Perplexity. En lugar de enrutar la recuperación a través de una única interfaz fija, Search as Code expone primitivas de búsqueda que un modelo compone bajo demanda en una canalización de recuperación para cada solicitud. Eso es lo que permite que los preajustes de gama alta ejecuten miles de pasos de recuperación en una sola llamada.

También es lo que permite que los preajustes de toda la gama ofrezcan mejores respuestas por dólar que una canalización tradicional de búsqueda y modelo. Los desarrolladores obtienen las mismas primitivas sobre las que se construyen los propios productos de Perplexity, en la misma API.

Mayor calidad por dólar en las pruebas de rendimiento

Evaluamos los preajustes de la Agent API y los modelos de Sonar con cargas de trabajo idénticas en tres pruebas de rendimiento: BrowseComp, que mide la navegación de agentes en preguntas que requieren encadenar muchas búsquedas; DeepSearchQA, que mide la calidad de las respuestas en preguntas de búsqueda profunda; y WideSearch, que mide la exhaustividad con la que una ejecución recopila y completa resultados estructurados.

Agent API frente a Sonar

El preajuste low ofrece una mejora de aproximadamente 7 veces en BrowseComp en comparación con Sonar Pro por un costo aproximado de $0.05 por consulta. Los preajustes de la Agent API pueden igualar a Sonar Deep Research a una fracción del costo.

Próximos pasos para los usuarios de Sonar

Si los usuarios llaman a Sonar hoy, deberán dirigir su integración a la Agent API antes de la fecha de retirada. Es un cambio pequeño: la elección del modelo existente se asigna a un preajuste coincidente, y los formatos de solicitud y respuesta son ligeramente diferentes.

La mayoría de los equipos completan esto en minutos. Nuestra Skill de agente de codificación puede aplicar el cambio directamente, y la guía de migración en docs.perplexity.ai explica la correspondencia campo por campo para los ingenieros que lo hagan manualmente.

Si no se realiza ningún cambio antes de la fecha de retirada, las llamadas a Sonar dejarán de funcionar, por lo que recomendamos migrar con antelación durante el período de gracia.

Disponibilidad continua

Los puntos de acceso de Sonar siguen estando totalmente disponibles hoy en día. El 27 de septiembre de 2026, la Agent API se convertirá en la principal interfaz para este trabajo y los niveles de Sonar se retirarán en la misma fecha. Todos los niveles existentes se asignan a un preajuste con mejores resultados en las pruebas de rendimiento y un menor costo, por lo que el cambio consolida las cargas de trabajo en una sola infraestructura programable sin renunciar a nada. La documentación de migración, los detalles de los preajustes y la guía de correspondencia campo por campo se encuentran en docs.perplexity.ai.