Artikel

Perplexity Sonar dominiert die Bewertung der neuen Sucharena

Licht, das durch einen geometrischen und festen Boden bricht

Zusammenfassung

  • Rang #1: Sonar-Reasoning-Pro-High erzielte einenArena-Score von 1136 (±21/−19), der statistisch gesehen auf dem ersten Platz mit Googles Gemini-2.5-Pro-Grounding (1142 +14/-17) liegt. In direkten Kopf-an-Kopf-Duellen schlug Sonar-Reasoning-Pro-High Gemini-2.5-Pro-Grounding 53% der Zeit.

  • Sonar Dominanz: Perplexity-Modelle belegten die Ränge 1 bis 4, was eine signifikant bessere Leistung im Vergleich zu anderen bewerteten Modellen von Google und OpenAI darstellt.

  • Argumentationsvorteil: Modelle, die Argumentationsfähigkeiten einbeziehen (sonar-reasoning-pro und sonar-reasoning), erreichten höhere Platzierungen, was mit der allgemein beobachteten Benutzerpräferenz für Argumentationsmodelle im Einklang steht (Top 3 auf der Rangliste).

  • Tiefe der Suche: Sonar-Modelle führen tiefere Suchen durch und berücksichtigen mehr Quellen, wobei im Durchschnitt 2-3x mehr Quellen als bei vergleichbaren Gemini-Modellen zitiert werden.

LM Arena hat gerade ihre neue Search Arena Rangliste veröffentlicht, die suchverstärkte LLM-Systeme basierend auf menschlichen Vorlieben vergleicht. Das Modell Sonar-Reasoning-Pro von Perplexity hat den ersten Platz mit Gemini-2.5-Pro-Grounding geteilt, während die restlichen Sonar-Modelle Gemini-2.0-Flash-Grounding und alle Websuchmodelle von OpenAI übertrafen.

Search Arena Benchmarking

Im Gegensatz zu SimpleQAs Fokus auf enge faktische Genauigkeit bewertet LM Arena, wie Modelle bei echten Benutzeranfragen zu Themen wie Programmierung, Schreiben, Forschung und Empfehlungen abschneiden. Mit Search Arena fokussiert sich die Evaluierung auf aktuelle Ereignisse und schließt längere, komplexere Eingabeaufforderungen ein, wobei über 10.000 Stimmen menschlicher Präferenzen über 11 Modelle gesammelt wurden. Zwischen dem 18. März und dem 13. April 2025 forderte Search Arena Benutzer auf, Eingaben zu machen und auszuwählen, welche Modellantworten ihre Informationsbedürfnisse besser erfüllten.

Sonar Modellleistungergebnisse

Die Sonar-Modelle von Perplexity übertrafen viele der führenden State-of-the-Art-Modelle, einschließlich Gemini 2.0 Flash und GPT 4o Search. Unser Sonar-Reasoning-Pro Modell erzielte einen Score von 1136, statistisch gleichauf mit Gemini-2.5-Pro-Grounding (1142) an der Spitzenposition.

In direkten Kopf-an-Kopf-Duellen schlug Sonar-Reasoning-Pro-High Gemini-2.5-Pro-Grounding 53% der Zeit.

Die Evaluierung der Search Arena zeigte drei Faktoren, die stark mit menschlichen Präferenzen korrelieren:

  • Längere Antworten (Koef 0.255, p<0.05)

  • Höhere Zitationszahlen (Koef 0.234, p<0.05)

  • Zitationen aus Gemeinschafts-Webquellen

Die Rangliste zeigte eine klare Benutzerpräferenz für argumentationsverbesserte Modelle, wobei Sonar-Reasoning-Pro und Sonar-Reasoning zwei der Top-3-Platzierungen belegten. Kontrollversuche verstärkten diese Ergebnisse, indem sie zeigten, dass die Kontrolle über Zitationen dazu führte, dass sich die Modellplatzierungen angleichen, was darauf hinweist, dass die Suchtiefe ein wesentliches Leistungsunterscheidungsmerkmal ist.

Die Sonar-Modelle von Perplexity hatten eine wesentlich höhere Suchtiefe, wobei ppl-sonar-pro-high 2-3x mehr Quellen als vergleichbare Gemini-Modelle zitierte.

Was das für Nutzer bedeutet

Für Perplexity-Nutzer bestätigen diese Ergebnisse, dass Sonar-Modelle eine erstklassige Genauigkeit, umfassende Quellenzuordnung und qualitativ hochwertige Antworten über ein breites Themenspektrum bieten.

Perplexity Pro-Nutzer können weiterhin von diesen leistungsstarken Modellen profitieren, indem sie Sonar als ihr Standardmodell in den Einstellungen festlegen. API-Nutzer können auf diese Funktionen über unsere Sonar API-Angebote zugreifen, mit flexiblen Suchmodi, um Leistung und Kosteneffizienz im Gleichgewicht zu halten.

Obwohl wir stolz auf diese Leistung sind, bleiben wir auf kontinuierliche Verbesserung fokussiert. Die Evaluierung von Search Arena bietet wertvolle Einblicke in Benutzerpräferenzen, die unsere laufenden Entwicklungsanstrengungen informieren werden.

Einführung in Sonar

Treten Sie dem Perplexity-Mitbegründer & CTO, Denis Yarats, bei einer Übersicht über unsere API am 24. April um 11 Uhr PT bei. Denis wird eine Übersicht über die APIs von Perplexity geben, Benchmark-Ergebnisse teilen und API-Anwendungsfälle vorstellen.

Jetzt hier registrieren.

Loslegen mit Sonar.

Interessiert daran, die Zukunft unserer API-Plattform mitzugestalten? Wir stellen ein.

Treten Sie unserer Entwickler-Community bei, um über neue Releases, Funktionen und Updates stets auf dem Laufenden zu bleiben.

Interessiert daran, die Zukunft unserer API-Plattform mitzugestalten? Wir stellen ein.

Treten Sie unserer Entwickler-Community bei, um über neue Releases, Funktionen und Updates stets auf dem Laufenden zu bleiben.

Interessiert daran, die Zukunft unserer API-Plattform mitzugestalten? Wir stellen ein.

Treten Sie unserer Entwickler-Community bei, um über neue Releases, Funktionen und Updates stets auf dem Laufenden zu bleiben.