Susipažinkite su naujuoju „Sonar“: itin greitas modelis

Neįtikėtinai greitas modelis, optimizuotas „Perplexity“ paieškai

Nuo šiandien visi „Perplexity Pro“ naudotojai galės išbandyti naujausią „Sonar“ – „Perplexity“ nuosavo modelio, optimizuoto atsakymų kokybei ir naudotojo patirčiai – versiją. Sukurtas „Llama 3.3 70B“ pagrindu, „Sonar“ buvo papildomai apmokytas, kad pagerintų atsakymų faktų tikslumą ir skaitomumą numatytajame „Perplexity“ paieškos režime.

Atlikę išsamius internetinius A/B testus nustatėme, kad „Sonar“ gerokai lenkia savo klasės modelius, tokius kaip „GPT-4o mini“ ir „Claude 3.5 Haiku“, o pagal naudotojų pasitenkinimą glaudžiai prilygsta pažangiausiems modeliams, tokiems kaip „GPT-4o“ ir „Claude 3.5 Sonnet“, arba juos viršija. Veikiantis „Cerebras“ išvedimo infrastruktūros pagrindu, „Sonar“ veikia neįtikėtinai greitai – 1200 žetonų per sekundę greičiu, todėl atsakymus generuoja beveik akimirksniu.

„Perplexity“ naudotojai renka „Sonar“

Atlikome išsamius internetinius „Sonar“ A/B testus, kad išmatuotume naudotojų pasitenkinimą – pagrindinį rodiklį, kuris glaudžiai susijęs su produkto naudojimu ir išlaikymu. Šis rodiklis rodo, kiek naudotojai yra patenkinti ir įsitraukę uždavinėdami klausimus „Perplexity“ platformoje.

Mūsų vertinimai rodo, kad „Sonar“ pastebimai aplenkia ir „GPT-4o mini“, ir „Claude 3.5 Haiku“. Taip pat palyginome „Sonar“ su brangesniais pažangiaisiais modeliais ir nustatėme, kad jis lenkia „Claude 3.5 Sonnet“, o pagal našumą beveik prilygsta „GPT-4o“, kainuodamas tik trupmeną jo kainos ir pasiekdamas daugiau nei 10 kartų didesnį greitį.

Neįtikėtinai greitas veikimas leidžia gauti atsakymus akimirksniu

Veikiantis „Cerebras“ išvedimo infrastruktūros pagrindu, „Sonar“ pateikia atsakymus neįtikėtinai greitai ir pasiekia beveik 10 kartų spartesnį dekodavimo pralaidumą nei panašūs modeliai, tokie kaip „Gemini 2.0 Flash“. Tai leidžia beveik akimirksniu generuoti atsakymus, todėl „Sonar“ idealiai tinka greitai informacijai ieškoti arba išsamiems klausimams atsakyti.

„Sonar“ puikiai teikia faktiniais duomenimis pagrįstus ir aukštos kokybės atsakymus

Optimizavome „Sonar“ pagal du svarbiausius matmenis, kurie glaudžiai susiję su naudotojų pasitenkinimu – atsakymų faktų tikslumą ir skaitomumą.

Atsakymų faktų tikslumas: matuoja, kaip gerai modelis gali atsakyti į klausimus naudodamas faktus, pagrįstus paieškos rezultatais, ir jo gebėjimą išspręsti prieštaringą arba trūkstamą informaciją

Skaitomumas: matuoja modelio gebėjimą pateikti glaustą ir išsamų atsakymą tinkamai naudojant „markdown“ formatavimą tekstui tvarkyti

Mūsų rezultatai rodo, kad, palyginti su baziniu modeliu „Llama 3.3 70B Instruct“, „Sonar“ gerokai pagerina šiuos aspektus ir šiose pagrindinėse srityse netgi pralenkia kitus pažangiausius modelius†.

Be to, akademiniuose testuose, kuriais matuojamas naudotojų nurodymų vykdymas ir pasaulio žinios, „Sonar“ taip pat lenkia tos pačios klasės modelius, tokius kaip „GPT-4o mini“ ir „Claude 3.5 Haiku“.

IFEval: matuoja, kaip gerai modelis laikosi naudotojo pateiktų nurodymų

MMLU: vertina pasaulio žinias įvairiose srityse

Kaip „Sonar“ atsako į klausimus

Kaip praktikoje atrodo didesnis faktų tikslumas ir skaitomumas? Palyginkite šias paieškas, kurios buvo atliktos naudojant „Sonar“ ir kitus modelius, kad pamatytumėte skirtumą.

Naudokite „Sonar“ jau šiandien

„Sonar“ puikiai teikia greitus ir tikslius atsakymus, todėl jis yra puikus modelis kasdieniam naudojimui. „Perplexity Pro“ naudotojai gali nustatyti „Sonar“ kaip numatytąjį modelį savo nustatymuose. Jį taip pat galima naudoti per „Sonar“ API pasiūlymą*.

Išnašos

†Šie vertinimai vertinami nuo 0 iki 100 balų skalėje, kur didesnis balas yra geresnis

*Per API teikiamas „Sonar“ modelis dar neveikia „Cerebras“ išvedimo infrastruktūroje, tačiau jis pasirodys netrukus