Упознајте нови Sonar: Муњевито брз модел оптимизован за претрагу на платформи Perplexity

Муњевито брз модел оптимизован за претрагу на платформи Perplexity

Почев од данас, сви корисници сервиса Perplexity Pro моћи ће да испробају најновију верзију модела Sonar, сопственог модела компаније Perplexity који је оптимизован за квалитет одговора и корисничко искуство. Направљен на врху модела Llama 3.3 70B, Sonar је додатно обучен ради побољшања чињеничне тачности и читљивости одговора за подразумевани режим претраге компаније Perplexity.

Кроз свеобухватно онлајн A/B тестирање, утврдили смо да Sonar значајно надмашује моделе у својој класи, као што су GPT-4o mini и Claude 3.5 Haiku, док у погледу корисничког задовољства у стопу прати или превазилази перформансе врхунских модела као што су GPT-4o и Claude 3.5 Sonnet. Покретан инфраструктуром за инференцију компаније Cerebras, Sonar ради невероватно брзо брзином од 1200 токена у секунди — омогућавајући генерацију одговора за готово стотину делова секунде.

Корисници сервиса Perplexity више воле Sonar

Спровели смо опсежно онлајн A/B тестирање модела Sonar како бисмо измерили задовољство корисника — кључну метрику која је у снажној корелацији са коришћењем производа и задржавањем корисника. Ова метрика приказује колико су корисници задовољни и ангажовани када постављају питања на платформи Perplexity.

Наше евалуације показују да Sonar значајном маргином надмашује и GPT-4o mini и Claude 3.5 Haiku. Такође смо упоредили Sonar са скупљим врхунским моделима и утврдили да надмашује Claude 3.5 Sonnet, док се уз делић цене и више од 10 пута већу брзину опасно приближава перформансама модела GPT-4o.

Невероватна брзина омогућава тренутне одговоре

Покретан инфраструктуром за инференцију компаније Cerebras, Sonar испоручује одговоре невероватно брзо, постижући проток декодирања који је скоро 10 пута бржи од упоредивих модела као што је Gemini 2.0 Flash. Ово омогућава скоро тренутну генерацију одговора, што чини Sonar идеалним за брзо претраживање информација или детаљне случајеве употребе одговора на питања.

Sonar се истиче у пружању чињеничних и висококвалитетних одговора

Оптимизовали смо Sonar у две критичне димензије које су у снажној корелацији са задовољством корисника — чињеничној тачности одговора и читљивости.

Чињенична тачност одговора: Мери колико добро модел може да одговори на питања користећи чињенице које су засноване на резултатима претраге, као и његову способност да разреши конфликтне или недостајуће информације

Читљивост: Мери способност модела да пружи сажет и детаљан одговор уз одговарајућу употребу маркдаун форматирања за организовање текста

Наши резултати показују да Sonar значајно побољшава ове аспекте у поређењу са основним моделом, Llama 3.3 70B Instruct, па чак и надмашује друге врхунске моделе у овим кључним областима†.

Поред тога, Sonar такође надмашује моделе из исте класе као што су GPT-4o mini и Claude 3.5 Haiku на академским бенчмарцима који мере праћење упутстава корисника и опште знање.

IFEval: Мери колико се модел придржава упутстава која су обезбедили корисници

MMLU: Процењује опште знање у различитим доменима

Како Sonar одговара на питања

Како повећана тачност и читљивост изгледају у пракси? Упоредите ове претраге, које су спроведене и на моделу Sonar и на другим моделима како бисте видели разлику.

Користите Sonar већ данас

Sonar се истиче у пружању брзих и тачних одговора, што га чини одличним моделом за свакодневну употребу. Корисници сервиса Perplexity Pro могу да поставе Sonar као свој подразумевани модел у својим подешавањима. Такође се може користити путем Sonar API понуде*.

Фусноте

†Ове евалуације се оцењују на скали од 0 до 100, при чему је већи број бољи

*Модел Sonar који се сервисира преко API-ја још увек не ради на инфраструктури за инференцију компаније Cerebras, али ускоро стиже