Artigo
Conheça o Novo Sonar

Conheça o novo Sonar: Um Modelo Extremamente Rápido Otimizado para Perplexity Search
A partir de hoje, todos os usuários do Perplexity Pro poderão experimentar a versão mais recente do Sonar, o modelo interno da Perplexity otimizado para qualidade de resposta e experiência do usuário. Construído sobre o Llama 3.3 70B, o Sonar foi ainda mais treinado para aprimorar a factualidade e a legibilidade das respostas no modo de pesquisa padrão da Perplexity.
Através de testes A/B online abrangentes, descobrimos que o Sonar supera significativamente modelos de sua classe, como o GPT-4o mini e o Claude 3.5 Haiku, enquanto se aproxima ou excede o desempenho de modelos de ponta como o GPT-4o e o Claude 3.5 Sonnet em termos de satisfação do usuário. Impulsionado pela infraestrutura de inferência da Cerebras, o Sonar opera a uma velocidade extremamente rápida de 1200 tokens por segundo — permitindo a geração de respostas quase instantânea.
Usuários da Perplexity Preferem o Sonar
Conduzimos extensos testes A/B online do Sonar para medir a satisfação do usuário — uma métrica chave fortemente correlacionada com o uso e retenção do produto. Esta métrica captura o quão satisfeitos e engajados estão os usuários ao fazer perguntas na Perplexity.
Nossas avaliações mostram que o Sonar supera tanto o GPT-4o mini quanto o Claude 3.5 Haiku por uma margem substancial. Também comparamos o Sonar com modelos de ponta mais caros e constatamos que ele supera o Claude 3.5 Sonnet, enquanto se aproxima do desempenho do GPT-4o a uma fração do preço e mais de 10 vezes a velocidade.

Velocidade Extremamente Rápida Permite Respostas Instantâneas
Impulsionado pela infraestrutura de inferência da Cerebras, o Sonar oferece respostas em velocidades extremamente rápidas, alcançando uma taxa de decodificação quase 10 vezes mais rápida que modelos comparáveis como o Gemini 2.0 Flash. Isso possibilita a geração de respostas quase instantâneas, tornando o Sonar ideal para recuperação rápida de informações ou casos de uso de respostas detalhadas.


Sonar se Destaca na Fornecimento de Respostas Fatuais e de Alta Qualidade
Otimizamos o Sonar em duas dimensões críticas que estão fortemente correlacionadas com a satisfação do usuário — factualidade e legibilidade das respostas.
Factualidade das Respostas: Mede quão bem um modelo pode responder perguntas usando fatos baseados em resultados de pesquisa e sua capacidade de resolver informações conflitantes ou ausentes
Legibilidade: Mede a capacidade de um modelo em fornecer uma resposta concisa e detalhada com o uso apropriado de formatação markdown para organizar o texto
Nossos resultados demonstram que o Sonar melhora significativamente esses aspectos em comparação com o modelo base, o Llama 3.3 70B Instruct, e até supera outros modelos de ponta nessas áreas-chave†.
Além disso, o Sonar também supera modelos da sua classe como o GPT-4o mini e o Claude 3.5 Haiku em benchmarks acadêmicos que medem o seguimento de instruções dos usuários e o conhecimento mundial.
IFEval: Mede quão bem um modelo adere às instruções fornecidas pelo usuário
MMLU: Avalia o conhecimento mundial em diversos domínios

Como o Sonar Responde Perguntas
Como a maior factualidade e legibilidade se manifestam na prática? Compare estas pesquisas, que foram realizadas tanto no Sonar quanto em outros modelos para ver a diferença.




Utilize o Sonar Hoje
O Sonar se destaca em fornecer respostas rápidas e precisas, tornando-se um ótimo modelo para uso diário. Usuários do Perplexity Pro podem definir o Sonar como seu modelo padrão em suas configurações. Ele também pode ser usado através da oferta de API do Sonar*.

Notas de Rodapé
†Estas avaliações são classificadas em uma escala de 0 a 100, onde valores mais altos são melhores
*O modelo Sonar servido através da API ainda não opera na infraestrutura de inferência da Cerebras, mas estará disponível em breve