Mistral lança modelo de IA para reduzir distância em relação à China
A Mistral lançou nessa terça-feira (6) o Mistral Large 4 (ML4), seu novo modelo de inteligência artificial de ponta, que a empresa francesa afirma ser o modelo de código aberto mais capaz desenvolvido fora da China.
O lançamento acontece em um momento em que desenvolvedores ocidentais correm para reduzir a distância de desempenho em relação às empresas chinesas no segmento de modelos abertos.
Segundo a CNBC, o ML4, também chamado de “le Chonk”, é um modelo com um trilhão de parâmetros especialmente eficaz em tarefas de segurança cibernética, programação, manufatura, finanças e aplicações multimodais.
A Mistral afirma que o modelo supera qualquer outro modelo de pesos abertos desenvolvido fora da China por uma “margem substancial” em benchmarks agregados de desempenho.
O acesso a modelos de inteligência artificial abertos tornou-se um ponto central na disputa tecnológica entre Estados Unidos e China.
Ao contrário dos sistemas fechados líderes, como os da OpenAI e da Anthropic, modelos abertos podem ser modificados e hospedados localmente, e os modelos chineses de código aberto têm sido cada vez mais adotados ao redor do mundo.
Treinamento e lançamento gradual O ML4 foi treinado ao longo de dois meses em 4 mil unidades de processamento gráfico (GPU) Nvidia Grace Blackwell instaladas nos próprios data centers da Mistral na Europa.
O modelo está sendo lançado em fase de visualização para desenvolvedores, líderes de segurança cibernética e autoridades governamentais antes de sua disponibilização ampla, prevista para o restante deste mês.
Leia também: CERC eleva produtividade em 67% com ecossistema de agentes de IA A empresa reconhece que o novo modelo ainda fica atrás dos sistemas de fronteira em programação.
O cofundador e cientista-chefe da Mistral, Guillaume Lample , diz que “as capacidades do modelo vão continuar melhorando à medida que escalamos nossa capacidade de treinamento, após nossa rodada da Série D”.
Lample também observa que “as capacidades de defesa cibernética vão permitir que empresas e governos se defendam de agentes maliciosos que fazem jailbreaking de modelos fechados para realizar ataques cibernéticos”.
Contexto: a corrida pelos modelos abertos O interesse em modelos abertos cresceu após um episódio envolvendo a Hugging Face, que recorreu ao modelo GLM 5.2 da Z.ai, empresa com base na China, para se defender de uma invasão por agentes rogue da OpenAI.
A organização havia tentado primeiro os principais sistemas fechados americanos, mas foi bloqueada por guardrails que interpretaram suas ações como um ataque.
Na segunda-feira (5), a startup americana Reflection AI , apoiada pela Nvidia, lançou seu primeiro modelo aberto, afirmando que ele rivaliza com o GLM 5.2.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em itforum.com.br — o conteúdo pertence a IT Forum.