Upoznajte novi Sonar: Izuzetno brz model za pretragu

Izuzetno brz model optimizovan za pretragu na platformi Perplexity

Počevši od danas, svi korisnici pretplate Perplexity Pro moći će da isprobaju najnoviju verziju modela Sonar, sopstvenog modela kompanije Perplexity koji je optimizovan za kvalitet odgovora i korisničko iskustvo. Izgrađen na osnovu modela Llama 3.3 70B, Sonar je dodatno obučen radi poboljšanja činjenične tačnosti odgovora i čitljivosti za podrazumevani režim pretrage kompanije Perplexity.

Kroz sveobuhvatno onlajn A/B testiranje utvrdili smo da Sonar značajno nadmašuje modele iz svoje klase, kao što su GPT-4o mini i Claude 3.5 Haiku, istovremeno se približavajući ili prevazilazeći performanse vodećih modela poput GPT-4o i Claude 3.5 Sonnet u pogledu zadovoljstva korisnika. Pokretan infrastrukturnim rešenjem za inferenciju kompanije Cerebras, Sonar radi neverovatnom brzinom od 1200 tokena u sekundi, čime se omogućava skoro trenutno generisanje odgovora.

Korisnici platforme Perplexity preferiraju model Sonar

Sproveli smo opsežno onlajn A/B testiranje modela Sonar radi merenja zadovoljstva korisnika, što predstavlja ključni pokazatelj koji je u snažnoj korelaciji sa upotrebom proizvoda i zadržavanjem korisnika. Ovaj pokazatelj odražava koliko su korisnici zadovoljni i angažovani prilikom postavljanja pitanja na platformi Perplexity.

Naše procene pokazuju da Sonar značajno prevazilazi i GPT-4o mini i Claude 3.5 Haiku. Takođe smo uporedili Sonar sa skupljim vodećim modelima i utvrdili da nadmašuje Claude 3.5 Sonnet, uz blisko približavanje performansama modela GPT-4o uz delić cene i više nego desetostruko veću brzinu.

Neverovatna brzina omogućava trenutne odgovore

Pokretan infrastrukturnim rešenjem za inferenciju kompanije Cerebras, Sonar isporučuje odgovore neverovatnom brzinom, ostvarujući propusni opseg dekodiranja koji je skoro 10 puta brži od uporedivih modela kao što je Gemini 2.0 Flash. To omogućava skoro trenutno generisanje odgovora, što model Sonar čini idealnim za brzo preuzimanje informacija ili složene slučajeve upotrebe u svrhe davanja odgovora na pitanja.

Sonar se ističe pružanjem činjeničnih i visokokvalitetnih odgovora

Optimizovali smo model Sonar u dve ključne dimenzije koje su u snažnoj korelaciji sa zadovoljstvom korisnika – činjeničnost odgovora i čitljivost.

Činjeničnost odgovora: Meri sposobnost modela da odgovara na pitanja koristeći činjenice utemeljene na rezultatima pretrage, kao i njegovu sposobnost da rešava protivrečne ili nedostajuće informacije

Čitljivost: Meri sposobnost modela da pruži sažet i detaljan odgovor uz odgovarajuću primenu markdown formatiranja za organizovanje teksta

Naši rezultati pokazuju da Sonar značajno unapređuje ove aspekte u poređenju sa osnovnim modelom Llama 3.3 70B Instruct, a u ovim ključnim oblastima čak nadmašuje i druge vodeće modele†.

Pored toga, Sonar nadmašuje i modele iste klase, kao što su GPT-4o mini i Claude 3.5 Haiku, na akademskim etalonima koji mere praćenje korisničkih instrukcija i opšte znanje.

IFEval: Meri u kojoj meri model poštuje instrukcije koje je dao korisnik

MMLU: Vrednuje opšte znanje u različitim oblastima

Kako Sonar odgovara na pitanja

Kako povećana činjeničnost i čitljivost izgledaju u praksi? Uporedite ove pretrage, koje su sprovedene na modelu Sonar i drugim modelima, kako biste videli razliku.

Koristite Sonar već danas

Sonar se ističe pružanjem brzih i tačnih odgovora, što ga čini odličnim modelom za svakodnevnu upotrebu. Korisnici pretplate Perplexity Pro mogu podesiti Sonar kao svoj podrazumevani model u svojim podešavanjima. Takođe se može koristiti putem Sonar API ponude*.

Fusnote

†Ove procene se ocenjuju na skali od 0 do 100, pri čemu viša vrednost označava bolji rezultat

*Model Sonar koji se isporučuje putem API-ja još uvek ne radi na infrastrukturnom rešenju za inferenciju kompanije Cerebras, ali će uskoro biti dostupan