A empresa francesa Mistral AI apresentou o Mistral Large 4 (ML4), um novo modelo multimodal de grande escala com 1 trilhão de parâmetros, posicionado como alternativa aos modelos fechados americanos e aos modelos abertos frequentemente desenvolvidos na China.
Características técnicas e acesso
O modelo, apelidado "Le Chonk" em referência à sua escala de parâmetros, será disponibilizado através de um endpoint público com proteções de segurança. Mistral planeja liberar os pesos do modelo após três semanas, uma vez concluídos os testes de segurança. Inicialmente, o acesso será restrito a parceiros confiáveis e governos, para garantir que os pesos de código aberto sejam utilizados apenas para defesa e não para ataques maliciosos, conforme indicado por Pierre Stock, vice-presidente de Ciência da Mistral.
Eficiência computacional
Um aspecto destacado é a eficiência do treinamento: o ML4 foi treinado utilizando apenas 4 mil GPUs Nvidia, correspondendo a duas ou três vezes menos recursos computacionais que competidores chineses e significativamente menos que rivais de modelos fechados.
Casos de uso e aplicações
O modelo foi otimizado para casos de uso específicos que agregam valor aos clientes da Mistral, particularmente em cibersegurança e finanças. O design de chips também figura como área de foco, relevante para dois dos principais investidores da empresa: a holandesa ASML, que liderou sua rodada Series C, e a Samsung, que liderou a rodada Series D com avaliação da empresa em €21 bilhões (aproximadamente US$ 24,39 bilhões).
Posicionamento estratégico
Mistral posiciona o ML4 como uma terceira via em IA, distinta tanto de modelos fechados quanto de alternativas abertas. A empresa reafirma seu status como laboratório de fronteira na pesquisa de IA, rejeitando percepções de que estaria se tornando meramente um provedor de inferência. Resultados de benchmarks ainda estão pendentes, mas a empresa espera que o modelo seja o melhor entre modelos de pesos abertos, particularmente fora da China.










