Perplexity Sonar dominira u novoj proceni Search Arene
Perplexity Sonar modeli zauzimaju vodeća mesta u proceni pretrage

Ukratko
- Co br. 1: Sonar-Reasoning-Pro-High je ostvario skor na Areni od 1136 (±21/−19), čime deli prvo mesto sa Google-ovim modelom Gemini-2.5-Pro-Grounding (1142 +14/−17). U direktnim okršajima, Sonar-Reasoning-Pro-High je pobedio model Gemini-2.5-Pro-Grounding u 53% slučajeva.
- Dominacija Sonara: Perplexity modeli su osigurali pozicije od 1 do 4, značajno nadmašujući druge ocenjivane modele iz kompanija Google i OpenAI.
- Prednost u zaključivanju: Modeli koji uključuju sposobnosti zaključivanja (sonar-reasoning-pro i sonar-reasoning) rangirani su više, što je u skladu sa opštom preferencijom korisnika uočenom za modele za zaključivanje (prva 3 mesta na rang-listi).
- Dubina pretrage: Sonar modeli obavljaju dublju pretragu i uzimaju u obzir više izvora, u proseku citirajući 2-3 puta više izvora od uporedivih Gemini modela.
______
LM Arena je upravo objavila svoju novu rang-listu Search Arena koja upoređuje sisteme jezičkih modela sa proširenom pretragom na osnovu preferencija korisnika. Perplexity-jev model Sonar-Reasoning-Pro deli prvo mesto sa modelom Gemini-2.5-Pro-Grounding, dok ostali Sonar modeli nadmašuju model Gemini-2.0-Flash-Grounding i sve OpenAI-jeve modele veb pretrage.

Upoređivanje performansi na Search Areni
Za razliku od fokusa modela SimpleQA na usku činjeničnu tačnost, LM Arena ocenjuje kako modeli funkcionišu na upitima stvarnih korisnika u oblastima kodiranja, pisanja, istraživanja i preporuka. Sa Search Arenom, procena se fokusira na aktuelne događaje i uključuje duže, složenije unose, prikupljajući preko 10.000 glasova korisnika za 11 modela. Između 18. marta i 13. aprila 2025. godine, Search Arena je tražila od korisnika da unose upite i izaberu koji odgovor modela bolje zadovoljava njihove potrebe za informacijama.
Rezultati performansi Sonar modela
Perplexity-jevi Sonar modeli nadmašili su mnoge vodeće najsavremenije modele, uključujući Gemini 2.0 Flash i GPT 4o Search. Naš model Sonar-Reasoning-Pro postigao je skor od 1136, čime deli prvo mesto sa modelom Gemini-2.5-Pro-Grounding (1142).

Procena Search Arene otkrila je tri faktora koja su u snažnoj korelaciji sa preferencijama korisnika:
- Duži odgovori (koef. 0.255, p<0.05)
- Veći broj citata (koef. 0.234, p<0.05)
- Citati iz izvora zajednice na vebu
Rang-lista je pokazala jasnu preferenciju korisnika prema modelima sa poboljšanim sposobnostima zaključivanja, pri čemu su Sonar-Reasoning-Pro i Sonar-Reasoning zauzeli dva od prva tri mesta. Kontrolni eksperimenti su potvrdili ove nalaze, pokazujući da kontrolisanje citata dovodi do konvergencije rangiranja modela, što sugeriše da je dubina pretrage značajan faktor diferencijacije performansi.

Šta ovo znači za korisnike
Za Perplexity korisnike, ovi rezultati potvrđuju da Sonar modeli pružaju vodeću tačnost u klasi, sveobuhvatnu atribuciju izvora i visokokvalitetne odgovore u širokom spektru tema.
Perplexity Pro korisnici mogu nastaviti da koriste ove najbolje rangirane modele postavljanjem modela Sonar kao podrazumevanog modela u podešavanjima. Korisnici API-ja mogu pristupiti ovim mogućnostima preko naših Sonar API ponuda sa fleksibilnim režimima pretrage radi balansiranja performansi i troškovne efikasnosti
Iako smo ponosni na ovo dostignuće, ostajemo fokusirani na kontinuirano poboljšanje. Procena Search Arene pruža dragocene uvidu u preferencije korisnika koji će usmeravati naše tekuće napore u razvoju.

Uvod u Sonar
Pridružite se suosnivaču i tehničkom direktoru (CTO) kompanije Perplexity, Denisu Jaratsu, na predstavljanju našeg API-ja 24. aprila u 11:00 po pacifičkom vremenu. Denis će predstaviti Perplexity-jeve API-je, podeliti rezultate benčmarkinga i primere korišćenja API-ja.
Registrujte se ovde.