API de Agentes: un lugar para crear con LLMs, la Web y Agentes
La API de Agentes de Perplexity es un único extremo programable para búsqueda web, obtención de URL, ejecución de código, MCP y búsqueda de finanzas y personas, con ajustes preestablecidos configurables.

Perplexity está construyendo la infraestructura para el trabajo que depende de modelos de lenguaje, la web pública y agentes que se ejecutan en ambos. La API de Agentes es la forma en que los desarrolladores se conectan a esa infraestructura. Es un único extremo programable para búsqueda web, obtención de URL, ejecución de código, conexiones MCP y búsqueda de finanzas y personas. Para cada solicitud, estas capacidades se combinan bajo demanda en una canalización de recuperación.
Hoy estamos actualizando a todos los clientes de Sonar a un ajuste preestablecido de la API de Agentes que obtiene mejores resultados en las pruebas comparativas a un menor costo. Sonar seguirá disponible durante 45 días antes de que la API de Agentes se convierta en la única superficie para este trabajo. Los clientes con compromisos contractuales existentes con Sonar están cubiertos hasta el final de su período actual.
Los equipos la usan para crear agentes de investigación, experiencias de respuestas dentro de productos y automatizaciones de flujos de trabajo que necesitan información actualizada y citada, sin tener que integrar por separado un proveedor de búsqueda, un host de modelos, un entorno de ejecución de herramientas y una capa de orquestación.
Una superficie programable
Antes de la API de Agentes, Sonar exponía la funcionalidad a través de un conjunto fijo de modelos: Sonar, Sonar Pro, Sonar Reasoning Pro y Sonar Deep Research. Elegir un modelo significaba elegir un paquete estático de profundidad de razonamiento, comportamiento de búsqueda y costo, y vincular ese paquete al código de producción. Cada nivel era una decisión de producto independiente en lugar de una configuración de una pila compartida.
La API de Agentes reduce esos niveles a una sola superficie programable. Seis ajustes preestablecidos (fast, low, medium, high, xhigh y wide-research) se encuentran en la misma infraestructura y la exponen en diferentes puntos de la curva de calidad y costo. Cada ajuste preestablecido es una configuración transparente y preconfigurada: un modelo vinculado a una indicación del sistema, una configuración de herramientas, un esfuerzo de razonamiento y presupuestos de tokens ajustados a cargas de trabajo reales.
Los ajustes preestablecidos se vuelven a calibrar con cada lanzamiento de un modelo de vanguardia, por lo que una llamada a low hoy y la misma llamada dentro de seis meses reflejan el estado actual de la técnica a un costo predecible. Todos los parámetros siguen siendo reemplazables.
Los niveles de Sonar se corresponden directamente con los ajustes preestablecidos: sonar con fast, sonar-pro con low, sonar-reasoning-pro con medium y sonar-deep-research con high. El ajuste preestablecido xhigh va más allá de la Investigación profunda para el trabajo de agentes abiertos.
Búsqueda como código, la capa subyacente
La API de Agentes incluye búsqueda web, obtención de URL, un entorno aislado de código, conexiones de servidores MCP, búsqueda financiera y búsqueda de personas. Los ajustes preestablecidos configuran estas herramientas de forma predeterminada y todas las herramientas están disponibles para cualquier configuración de agente personalizada.
Estas herramientas se encuentran sobre Búsqueda como código, la arquitectura detrás de la pila de búsqueda de Perplexity. En lugar de enrutar la recuperación a través de una única interfaz fija, Búsqueda como código expone primitivas de búsqueda que un modelo compone bajo demanda en una canalización de recuperación para cada solicitud. Eso es lo que permite que los ajustes preestablecidos de gama alta ejecuten miles de pasos de recuperación en una sola llamada.
También es lo que permite que los ajustes preestablecidos en toda la gama ofrezcan mejores respuestas por dólar que una canalización tradicional de búsqueda más modelo. Los desarrolladores obtienen las mismas primitivas sobre las que se construyen los propios productos de Perplexity, en la misma API.
Mayor calidad por dólar en todas las pruebas comparativas
Evaluamos los ajustes preestablecidos de la API de Agentes y los modelos de Sonar en cargas de trabajo idénticas en tres pruebas comparativas: BrowseComp, que mide la navegación de agentes en preguntas que requieren encadenar muchas búsquedas; DeepSearchQA, que mide la calidad de las respuestas en preguntas de búsqueda profunda, y WideSearch, que mide qué tan completamente una ejecución recopila y completa resultados estructurados.

El ajuste preestablecido low ofrece una mejora de aproximadamente 7x en BrowseComp en comparación con Sonar Pro a aproximadamente $0.05 por consulta. Los ajustes preestablecidos de la API de Agentes pueden igualar a Sonar Investigación profunda a una fracción del costo.
Próximos pasos para los usuarios de Sonar
Si los usuarios llaman a Sonar hoy, deberán orientar su integración hacia la API de Agentes antes de la fecha de retirada. Es un cambio pequeño: la elección del modelo existente se asigna a un ajuste preestablecido correspondiente y los formatos de solicitud y respuesta son ligeramente diferentes.
La mayoría de los equipos completan esto en minutos. Nuestra Skill de agente de código puede aplicar el cambio en el lugar, y la guía de migración en docs.perplexity.ai explica la asignación campo por campo para los ingenieros que lo hacen manualmente.
Si nada cambia para la fecha de retirada, las llamadas a Sonar dejarán de funcionar, por lo que recomendamos migrar anticipadamente durante el período de gracia.
Disponibilidad continua
Los puntos de conexión de Sonar siguen estando totalmente disponibles hoy en día. El 27 de septiembre de 2026, la API de Agentes se convertirá en la superficie principal para este trabajo y los niveles de Sonar se retirarán en la misma fecha. Cada nivel existente se asigna a un ajuste preestablecido que obtiene mejores resultados en las pruebas comparativas a un menor costo, por lo que el cambio consolida las cargas de trabajo en una sola pila programable sin renunciar a nada. La documentación de migración, los detalles de los ajustes preestablecidos y la guía de asignación campo por campo se encuentran en docs.perplexity.ai.