
Casos de uso
Conoce cómo evaluamos la inteligencia artificial
Funciones
Categorías
Resumen
Si te dedicas a la investigación de IA, ingeniería o liderazgo de producto, Perplexity te ayuda a entender cómo se evalúan actualmente los LLM. Deep Research analiza artículos académicos y reportes de la industria para explicarte no solo cómo funcionan los benchmarks, sino también sus fallas. Así, tu equipo podrá decidir con más confianza en qué métricas confiar al evaluar sus modelos.
Consejos
Cuéntale a Perplexity cómo estás usando el sistema (por ejemplo, si es para programar o para un asistente de soporte). Así podrán adaptar las pruebas a lo que realmente necesitas construir.
Pregunta sobre las nuevas formas de evaluación que vienen en camino para superar las limitaciones actuales; te servirá para estar bien preparado a futuro.
