Skip to main content

mistral, mistral ai

A Mistral lançou nessa terça-feira (6) o Mistral Large 4 (ML4), seu novo modelo de inteligência artificial de ponta, que a empresa francesa afirma ser o modelo de código aberto mais capaz desenvolvido fora da China. O lançamento acontece em um momento em que desenvolvedores ocidentais correm para reduzir a distância de desempenho em relação às empresas chinesas no segmento de modelos abertos.

Segundo a CNBC, o ML4, também chamado de “le Chonk”, é um modelo com um trilhão de parâmetros especialmente eficaz em tarefas de segurança cibernética, programação, manufatura, finanças e aplicações multimodais. A Mistral afirma que o modelo supera qualquer outro modelo de pesos abertos desenvolvido fora da China por uma “margem substancial” em benchmarks agregados de desempenho.

O acesso a modelos de inteligência artificial abertos tornou-se um ponto central na disputa tecnológica entre Estados Unidos e China. Ao contrário dos sistemas fechados líderes, como os da OpenAI e da Anthropic, modelos abertos podem ser modificados e hospedados localmente, e os modelos chineses de código aberto têm sido cada vez mais adotados ao redor do mundo.

Treinamento e lançamento gradual

O ML4 foi treinado ao longo de dois meses em 4 mil unidades de processamento gráfico (GPU) Nvidia Grace Blackwell instaladas nos próprios data centers da Mistral na Europa. O modelo está sendo lançado em fase de visualização para desenvolvedores, líderes de segurança cibernética e autoridades governamentais antes de sua disponibilização ampla, prevista para o restante deste mês.

Leia também: CERC eleva produtividade em 67% com ecossistema de agentes de IA

A empresa reconhece que o novo modelo ainda fica atrás dos sistemas de fronteira em programação. O cofundador e cientista-chefe da Mistral, Guillaume Lample, diz que “as capacidades do modelo vão continuar melhorando à medida que escalamos nossa capacidade de treinamento, após nossa rodada da Série D”. Lample também observa que “as capacidades de defesa cibernética vão permitir que empresas e governos se defendam de agentes maliciosos que fazem jailbreaking de modelos fechados para realizar ataques cibernéticos”.

Contexto: a corrida pelos modelos abertos

O interesse em modelos abertos cresceu após um episódio envolvendo a Hugging Face, que recorreu ao modelo GLM 5.2 da Z.ai, empresa com base na China, para se defender de uma invasão por agentes rogue da OpenAI. A organização havia tentado primeiro os principais sistemas fechados americanos, mas foi bloqueada por guardrails que interpretaram suas ações como um ataque.

Na segunda-feira (5), a startup americana Reflection AI, apoiada pela Nvidia, lançou seu primeiro modelo aberto, afirmando que ele rivaliza com o GLM 5.2. O modelo chinês, por sua vez, foi superado pelo GLM 5.3 em agosto.

A Mistral, considerada a principal representante europeia no campo das grandes empresas de inteligência artificial, captou três bilhões de euros (US$ 3,4 bilhões) em uma rodada Série D em setembro, com avaliação de 21 bilhões de euros. A rodada consolidou a posição da empresa como uma das startups de inteligência artificial mais bem financiadas da região.

Siga o IT Forum no LinkedIn e fique por dentro de todas as notícias!