
A comunidade de Inteligência Artificial recebe com entusiasmo o lançamento do modelo Mixtral 8x22B, que promete revolucionar o desempenho e a eficiência no campo. Com apenas 39B dos 141B parâmetros ativos, esse modelo de Mixture-of-Experts (SMoE) se destaca por sua eficiência de custo inigualável.
O Mixtral 8x22B é poliglota, dominando idiomas como inglês, francês, italiano, alemão e espanhol, além de exibir habilidades avançadas em matemática e codificação. Sua capacidade nativa de chamada de funções e a implementação do modo de saída restrito na plataforma 'la Plateforme' impulsionam o desenvolvimento de aplicações e a modernização de pilhas tecnológicas em larga escala.
Com uma janela de contexto de 64 mil tokens, o modelo consegue recuperar informações precisas de documentos extensos. A abordagem de código aberto, sob licença Apache 2.0, é um convite à inovação e colaboração, disponibilizando o Mixtral 8x22B para uso irrestrito.
O modelo se sobressai em eficiência de custo, tendo um desempenho superior a modelos densos de 70B e superando outros modelos de peso aberto, servindo como base robusta para casos de uso de ajustes finos.
Na avaliação de desempenho, o Mixtral 8x22B demonstra capacidades de raciocínio otimizadas, superando outros modelos abertos em benchmarks padrão da indústria, como MMLU, HellaSwag e Wino Grande. Em testes multilíngues, este modelo supera o LLaMA 2 70B em desafios como HellaSwag e Arc Challenge em francês, alemão, espanhol e italiano.
Nos benchmarks de codificação e matemática, Mixtral 8x22B se destaca entre os modelos abertos, apresentando desempenho superior em tarefas de codificação e matemática. A versão instruída do Mixtral 8x22B lançada hoje mostra desempenho ainda melhor em matemática, com pontuações impressionantes nos benchmarks GSM8K e Math.
Convidamos os desenvolvedores a explorar o Mixtral 8x22B na 'la Plateforme' e a se juntar à comunidade Mistral, à medida que definimos juntos a fronteira da IA.
Confira os últimos vídeos publicados no canal