Статья

Perplexity Sonar доминирует в новой оценке поисковой арены

Свет, пробивающийся сквозь геометрический и массивный пол

Краткий обзор

  • Ранг №1: Sonar-Reasoning-Pro-High достиг счет Арены 1136 (±21/−19), статистически разделив первое место с Google's Gemini-2.5-Pro-Grounding (1142 +14/-17). В прямых столкновениях Sonar-Reasoning-Pro-High побеждал Gemini-2.5-Pro-Grounding в 53% случаев.

  • Доминирование Sonar: Модели Perplexity заняли места с 1 по 4, существенно превосходя другие оцененные модели от Google и OpenAI.

  • Преимущество в рассуждениях: Модели, включающие способности к рассуждениям (sonar-reasoning-pro и sonar-reasoning), заняли более высокие места, совпадая с общей пользовательской предпочтения по моделям рассуждений (топ-3 в таблице лидеров).

  • Глубина поиска: Модели Sonar проводят более глубокий поиск и рассматривают больше источников, в среднем ссылаясь на 2-3 раза больше источников по сравнению с аналогичными моделями Gemini.

LM Arena только что выпустила новую таблицу лидеров Search Arena сравнивающую системы LLM, дополненные поиском, на основе пользовательских предпочтений. Модель Perplexity Sonar-Reasoning-Pro разделила первое место с Gemini-2.5-Pro-Grounding, в то время как остальные модели Sonar превзошли Gemini-2.0-Flash-Grounding и все модели веб-поиска OpenAI.

Бенчмаркинг Search Arena

В отличие от узконаправленного акцента SimpleQA на фактической точности, LM Arena оценивает, как модели работают с реальными пользовательскими запросами в областях кодирования, письма, исследований и рекомендаций. В Search Arena оценка сосредоточена на текущих событиях и включает более длинные и сложные запросы, собирая более 10,000 голосов предпочтения пользователей среди 11 моделей. Между 18 марта и 13 апреля 2025 года Search Arena просила пользователей предложить и выбрать, чей ответ модели лучше удовлетворил их информационные потребности.

Результаты производительности моделей Sonar

Модели Sonar от Perplexity превзошли многие из ведущих новейших моделей, включая Gemini 2.0 Flash и GPT 4o Search. Наша модель Sonar-Reasoning-Pro достигла счета 1136, что статистически соответствует Gemini-2.5-Pro-Grounding (1142) в верхней позиции.

В прямых схватках Sonar-Reasoning-Pro-High превосходил Gemini-2.5-Pro-Grounding в 53% случаев.

Оценка Search Arena выявила три фактора, сильно коррелирующих с пользовательскими предпочтениями:

  • Более длинные ответы (коэффициент 0.255, p<0.05)

  • Большое количество ссылок (коэффициент 0.234, p<0.05)

  • Ссылки на источники из веб-сообщества

Таблица лидеров показала явное предпочтение пользователей моделям с усиленными возможностями рассуждений, где Sonar-Reasoning-Pro и Sonar-Reasoning заняли два из трех верхних мест. Контрольные эксперименты подтвердили эти выводы, показав, что контроль количества цитат сужал позиции моделей, предполагая, что глубина поиска является значительным различием в производительности.

Модели Sonar от Perplexity имели существенно большую глубину поиска, с ppl-sonar-pro-high, ссылающимся на 2-3 раза больше источников по сравнению с эквивалентными моделями Gemini.

Что это значит для пользователей

Для пользователей Perplexity эти результаты подтверждают, что модели Sonar обеспечивают наивысший уровень точности, обширное определение источников и высококачественные ответы по широкому спектру тем.

Пользователи Perplexity Pro могут продолжать получать пользу от этих высокоэффективных моделей, установив Sonar в качестве своей модели по умолчанию в настройках. Пользователи API могут получить доступ к этим возможностям через наши предложения Sonar API с гибкими режимами поиска, чтобы балансировать между производительностью и экономической эффективностью.

Несмотря на достигнутый успех, мы остаёмся сосредоточены на постоянном совершенствовании. Оценка Search Arena предоставляет ценные инсайты в пользовательские предпочтения, которые будут влиять на наши текущие усилия по разработке.

Введение в Sonar

Присоединяйтесь к соучредителю и техническому директору Perplexity, Денису Яратсу, для обзора нашего API 24 апреля в 11:00 по тихоокеанскому времени. Денис предоставит обзор API Perplexity, поделится результатами тестирования и случаями использования API.

Зарегистрируйтесь здесь.

Начните с Sonar.

Интересуетесь формированием будущего нашей API платформы? Мы набираем сотрудников.

Присоединяйтесь к нашему сообществу разработчиков, чтобы быть в курсе новых релизов, функций и обновлений.

Интересуетесь формированием будущего нашей API платформы? Мы набираем сотрудников.

Присоединяйтесь к нашему сообществу разработчиков, чтобы быть в курсе новых релизов, функций и обновлений.

Интересуетесь формированием будущего нашей API платформы? Мы набираем сотрудников.

Присоединяйтесь к нашему сообществу разработчиков, чтобы быть в курсе новых релизов, функций и обновлений.