GLM-5.3 superou Mythos 5 e GPT-5.6 no benchmark CyberGym, mas ficou atrás dos rivais americanos no teste que mede a exploração de falhas
A empresa chinesa de inteligência artificial (IA) Zhipu, também conhecida como Z.ai, lançou seu modelo GLM-5.3 afirmando que ele superou o Mythos 5, modelo restrito de cibersegurança da Anthropic, em um benchmark-chave da área. Segundo a Zhipu, o GLM-5.3 atingiu taxa de sucesso de 84,5% no CyberGym, teste que mede a capacidade de um modelo de identificar e validar falhas de segurança a partir de código-fonte, acima dos 83,8% do Mythos e dos 83,6% do GPT-5.6 Sol, da OpenAI.
O modelo chinês, no entanto, não acompanhou os rivais americanos no ExploitBench, benchmark que mede até que ponto um modelo consegue avançar na exploração de uma vulnerabilidade já identificada: o GLM-5.3 pontuou 54,4%, contra 78% do Mythos e 76,5% do GPT-5.6 Sol.
Leia mais: IA acelera ascensão do profissional de alto impacto nas empresas
A Zhipu afirma ter testado o modelo com equipes de segurança na China contra bases de código reais, identificando 2.436 vulnerabilidades em 269 projetos após revisão de especialistas — das quais 1.097 foram classificadas como de severidade média a alta.
O lançamento acontece em meio à corrida entre empresas chinesas e ocidentais por modelos capazes de operar em cibersegurança ofensiva e defensiva, área em que a Anthropic restringe o acesso ao Mythos a organizações certificadas, dado o potencial de uso malicioso da tecnologia. “O desenvolvimento de IA não deveria ser uma performance solo de uma única nação, mas uma sinfonia de colaboração global”, afirmou a Zhipu.
Siga o IT Forum no LinkedIn e fique por dentro de todas as notícias!
Redação
Bruna Rocha
Pamela Sousa
Redação