Saltar para o conteúdo
goppo

Notícias · IA resumida para perceber o essencial

Voltar às notícias

Segurança e Ética

Publicado em

Microsoft lança MAI-Cyber-1-Flash para segurança de código

A Microsoft apresentou um modelo compacto para identificar e corrigir vulnerabilidades de software dentro do MDASH. A empresa afirma que a combinação reduz custos e reserva os modelos maiores para os casos mais difíceis.

  • ciberseguranca
  • microsoft
  • modelos-ia
  • agentes-ia
  • codigo

Resumo

A Microsoft apresentou o MAI-Cyber-1-Flash, um modelo de IA para segurança integrado no MDASH, a sua plataforma multiagente de identificação e correcção de vulnerabilidades. A proposta é analisar bases de código complexas, encontrar falhas e encaminhar a sua resolução.

Segundo a Microsoft, o sistema usa o MAI-Cyber-1-Flash para cerca de 90% das tarefas e recorre ao GPT-5.4 nos 10% de casos mais exigentes. A empresa diz que esta combinação atingiu 96% no benchmark CyberGym, 12 pontos acima do Mythos, e reduziu os custos em 50% face à sua configuração anterior no MDASH.

Na prática

O anúncio não apresenta o MAI-Cyber-1-Flash como um modelo autónomo de uso geral. O seu papel está ligado ao MDASH e a fluxos de segurança contínuos, onde agentes podem procurar, validar e corrigir vulnerabilidades.

Para equipas de segurança, o interesse está menos num único modelo e mais na divisão de trabalho: usar um modelo mais leve nas tarefas repetitivas e reservar modelos mais caros para investigações ou correcções que exigem mais raciocínio.

Contexto

A comparação divulgada pela Microsoft mede um sistema composto por modelo, dados e infraestrutura de agentes. Por isso, o resultado não permite concluir que o MAI-Cyber-1-Flash, isoladamente, supera todos os modelos comparados.

A Microsoft atribui a vantagem à combinação do modelo com dados históricos de incidentes e correcções, mais de 100 agentes especializados e controlos empresariais como isolamento de inquilinos, auditoria, encriptação e execução em ambientes sem acesso à internet. As métricas continuam a ser da própria empresa e requerem validação independente.

Porque importa

  • A segurança de código está a passar de verificações pontuais para monitorização e correcção mais contínuas.
  • Reduzir o custo por tarefa pode determinar se agentes de segurança são viáveis em grande escala.
  • Sistemas multi-modelo podem equilibrar desempenho e custo melhor do que depender sempre de um único modelo avançado.
  • Avaliar o sistema completo é importante, mas torna comparações directas entre modelos mais difíceis.