ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

Mistral aposta em IA ciber-capaz e aberta para desafiar a China, enquanto laboratórios dos EUA permanecem fechados

PorHannah CollymoreHannah Collymore 3 min de leitura
Mistral aposta em IA ciber-capaz e aberta para desafiar a China, enquanto laboratórios dos EUA permanecem fechados

Foto por Solen Feyissa no Unsplash

  • A Mistral apresentou o Large 4, um modelo de pesos abertos com um trilhão de parâmetros, destinado a desafiar o GLM-5.3 da China.
  • A Mistral está destacando as capacidades cibernéticas do Large 4 como uma alternativa aos modelos americanos restritos.
  • A empresa planeja liberar os pesos para download em 27 de outubro, após um teste de segurança de três semanas.

 

A Mistral lançou uma prévia pública de seu modelo de pesos abertos com um trilhão de parâmetros, o Mistral Large 4 (ML4), que ela considera o mais poderoso de sua categoria desenvolvido fora da China.

A segurança cibernética é o principal diferencial do modelo apelidado de “Le Chonk”. O modelo está disponível por meio da API da Mistral. Em seu anúncio, a empresa afirmou que publicará os pesos para download por volta de 27 de outubro, após um teste de três semanas com desenvolvedores, empresas de segurança e agências governamentais.

Uma semana antes, em 29 de setembro, a Anthropic compartilhou descobertas de sua pesquisa, alertando que o GLM-5.3 de pesos abertos da Zhipu AI, conhecido fora da China como Z.ai, pode construir autonomamente exploits cibernéticos funcionais. A empresa também afirmou que ele poderia vir com salvaguardas fracas o suficiente para serem contornadas na maioria das vezes.

“Fronteira dos modelos de pesos abertos” e o que os benchmarks mostram

O co-fundador e cientista-chefe Guillaume Lample afirmou: “O ML4 está na fronteira dos modelos de pesos abertos.”

O modelo, lançado na terça-feira, 6 de outubro, foi submetido a um teste preliminar no DeepSWE v1.1, um teste de codificação agêntica, colocando o Large 4 em 62%, apenas um ponto percentual acima do GLM-5.3.

Por que o aviso do GLM-5.3 da Anthropic é importante?

A pesquisa da Anthropic ajuda no posicionamento do produto da Mistral.

Em uma avaliação de 17 de setembro citada pela Anthropic, o Centro de Padrões e Inovação em IA do governo dos EUA classificou o GLM-5.3 como “o modelo de pesos abertos mais capaz em cibersegurança lançado até hoje”, ficando cerca de quatro meses atrás da fronteira dos EUA.

A própria equipe de Red Team (equipe de ataque) da Anthropic descobriu que o modelo poderia encadear falhas anteriormente desconhecidas em navegadores para criar uma exploração funcional em menos de um dia de trabalho levemente supervisionado.

As salvaguardas são o problema destacado pela Anthropic. A empresa escreveu que os atacantes contornaram as proteções integradas do GLM-5.3 “entre 64% e 100% das vezes” usando técnicas simples em testes simulados. A Anthropic afirmou que os mesmos ataques falharam contra os modelos Claude com salvaguardas.

Pesos abertos contra os modelos bloqueados pelos laboratórios dos EUA

As principais laboratórios de IA americanos mantiveram, em sua maioria, seus modelos mais capazes fora do lançamento geral. Um exemplo disso é o Anthropic Claude Mythos Preview, que é seu modelo cibernético mais capaz, e não está disponível para lançamento geral. 

O que a Anthropic está fazendo em vez disso é direcionar o modelo por meio do Project Glasswing para cerca de 40 organizações selecionadas, pois considerou o modelo perigoso demais para ser distribuído amplamente.

A OpenAI também adotou uma rota semelhante em abril, ao restringir sua variante GPT-5.4-Cyber atrás de verificações de identidade em camadas em seu programa Trusted Access for Cyber. Em setembro, ela afirmou que seu modelo Astra ultrapassou o limiar "Crítico" cibernético em seu Framework de Preparação.

A Mistral está seguindo uma rota diferente de seus concorrentes americanos. Ela não está restringindo o modelo, argumentando que as equipes de segurança precisam verificar seus próprios sistemas diariamente. Essas equipes também observam que os modelos fechados são frequentemente muito custosos nesse volume e, em alguns casos, recusam solicitações de uso duplo outright.

“As capacidades de defesa cibernética permitirão que empresas e governos se defendam contra agentes maliciosos que estão contornando modelos fechados para realizar ataques cibernéticos”, disse Lample. Desenvolvedores, empresas de segurança cibernética e agências governamentais na versão preliminar receberão uma versão com menos restrições do que a API pública.

Uma proposta de soberania respaldada por um aumento de €3 bilhões

Em setembro, a Mistral anunciou que captou €3 bilhões (US$ 3,5 bilhões) com uma avaliação acima de €21 bilhões. O Large 4 é o primeiro modelo lançado desde esse anúncio.

O modelo foi treinado do zero ao longo de dois meses em cerca de 4.000 GPUs Nvidia Grace Blackwell nos data centers europeus da Mistral.

As mentes mais inteligentes do setor de criptomoedas já leem nosso boletim informativo. Quer entrar? Junte-se a eles.

Perguntas Frequentes

O que é o Mistral Large 4 e quando as pessoas poderão baixá-lo?

O Large 4, codinome "Le Chonk", é um modelo multimodal com um trilhão de parâmetros e 49 bilhões de parâmetros ativos, disponível agora por meio da API da Mistral, com os pesos abertos previstos para publicação em 27 de outubro após um período de testes de três semanas.

Como o Large 4 se compara ao GLM-5.3 da China?

No benchmark preliminar DeepSWE v1.1 de codificação da Mistral, ele pontua 62% contra os 61% do GLM-5.3, embora o VentureBeat observe que o ranking ao vivo coloca o GLM-5.3 mais próximo de 69% em sua melhor configuração, então o Large 4 parece competitivo entre os modelos abertos sem uma liderança absoluta.

Por que a cibersegurança é central no lançamento?

A Mistral argumenta que as equipes de segurança precisam escanear sistemas diariamente e que os modelos fechados são frequentemente muito caros ou recusam solicitações de uso duplo, então um modelo aberto que os compradores podem executar por conta própria lhes dá mais controle, um argumento reforçado pela descoberta da Anthropic de que as salvaguardas do GLM-5.3 podem ser contornadas de 64% a 100% das vezes.

Compartilhe este artigo
Hannah Collymore

Hannah Collymore

Hannah é escritora e editora com quase uma década de experiência em redação de blogs e cobertura de eventos no espaço cripto. Na Cryptopolitan, Hannah contribui para a página de notícias, relatando e analisando os últimos desenvolvimentos nos setores DeFi, RWA, regulação cripto, IA e tecnologias de fronteira. Ela se formou na Universidade Arcadia com graduação em Administração de Empresas.

MAIS … NOTÍCIAS