Susipažinkite su naujuoju „Sonar“: itin greitas modelis
Neįtikėtinai greitas modelis, optimizuotas „Perplexity“ paieškai

Nuo šiandien visi „Perplexity Pro“ naudotojai galės išbandyti naujausią „Sonar“ – „Perplexity“ nuosavo modelio, optimizuoto atsakymų kokybei ir naudotojo patirčiai – versiją. Sukurtas „Llama 3.3 70B“ pagrindu, „Sonar“ buvo papildomai apmokytas, kad pagerintų atsakymų faktų tikslumą ir skaitomumą numatytajame „Perplexity“ paieškos režime.
Atlikę išsamius internetinius A/B testus nustatėme, kad „Sonar“ gerokai lenkia savo klasės modelius, tokius kaip „GPT-4o mini“ ir „Claude 3.5 Haiku“, o pagal naudotojų pasitenkinimą glaudžiai prilygsta pažangiausiems modeliams, tokiems kaip „GPT-4o“ ir „Claude 3.5 Sonnet“, arba juos viršija. Veikiantis „Cerebras“ išvedimo infrastruktūros pagrindu, „Sonar“ veikia neįtikėtinai greitai – 1200 žetonų per sekundę greičiu, todėl atsakymus generuoja beveik akimirksniu.
„Perplexity“ naudotojai renka „Sonar“
Atlikome išsamius internetinius „Sonar“ A/B testus, kad išmatuotume naudotojų pasitenkinimą – pagrindinį rodiklį, kuris glaudžiai susijęs su produkto naudojimu ir išlaikymu. Šis rodiklis rodo, kiek naudotojai yra patenkinti ir įsitraukę uždavinėdami klausimus „Perplexity“ platformoje.
Mūsų vertinimai rodo, kad „Sonar“ pastebimai aplenkia ir „GPT-4o mini“, ir „Claude 3.5 Haiku“. Taip pat palyginome „Sonar“ su brangesniais pažangiaisiais modeliais ir nustatėme, kad jis lenkia „Claude 3.5 Sonnet“, o pagal našumą beveik prilygsta „GPT-4o“, kainuodamas tik trupmeną jo kainos ir pasiekdamas daugiau nei 10 kartų didesnį greitį.

Neįtikėtinai greitas veikimas leidžia gauti atsakymus akimirksniu
Veikiantis „Cerebras“ išvedimo infrastruktūros pagrindu, „Sonar“ pateikia atsakymus neįtikėtinai greitai ir pasiekia beveik 10 kartų spartesnį dekodavimo pralaidumą nei panašūs modeliai, tokie kaip „Gemini 2.0 Flash“. Tai leidžia beveik akimirksniu generuoti atsakymus, todėl „Sonar“ idealiai tinka greitai informacijai ieškoti arba išsamiems klausimams atsakyti.


„Sonar“ puikiai teikia faktiniais duomenimis pagrįstus ir aukštos kokybės atsakymus
Optimizavome „Sonar“ pagal du svarbiausius matmenis, kurie glaudžiai susiję su naudotojų pasitenkinimu – atsakymų faktų tikslumą ir skaitomumą.
Atsakymų faktų tikslumas: matuoja, kaip gerai modelis gali atsakyti į klausimus naudodamas faktus, pagrįstus paieškos rezultatais, ir jo gebėjimą išspręsti prieštaringą arba trūkstamą informaciją
Skaitomumas: matuoja modelio gebėjimą pateikti glaustą ir išsamų atsakymą tinkamai naudojant „markdown“ formatavimą tekstui tvarkyti
Mūsų rezultatai rodo, kad, palyginti su baziniu modeliu „Llama 3.3 70B Instruct“, „Sonar“ gerokai pagerina šiuos aspektus ir šiose pagrindinėse srityse netgi pralenkia kitus pažangiausius modelius†.
Be to, akademiniuose testuose, kuriais matuojamas naudotojų nurodymų vykdymas ir pasaulio žinios, „Sonar“ taip pat lenkia tos pačios klasės modelius, tokius kaip „GPT-4o mini“ ir „Claude 3.5 Haiku“.
IFEval: matuoja, kaip gerai modelis laikosi naudotojo pateiktų nurodymų
MMLU: vertina pasaulio žinias įvairiose srityse

Kaip „Sonar“ atsako į klausimus
Kaip praktikoje atrodo didesnis faktų tikslumas ir skaitomumas? Palyginkite šias paieškas, kurios buvo atliktos naudojant „Sonar“ ir kitus modelius, kad pamatytumėte skirtumą.




Naudokite „Sonar“ jau šiandien
„Sonar“ puikiai teikia greitus ir tikslius atsakymus, todėl jis yra puikus modelis kasdieniam naudojimui. „Perplexity Pro“ naudotojai gali nustatyti „Sonar“ kaip numatytąjį modelį savo nustatymuose. Jį taip pat galima naudoti per „Sonar“ API pasiūlymą*.

Išnašos
†Šie vertinimai vertinami nuo 0 iki 100 balų skalėje, kur didesnis balas yra geresnis
*Per API teikiamas „Sonar“ modelis dar neveikia „Cerebras“ išvedimo infrastruktūroje, tačiau jis pasirodys netrukus