O modelo de inteligência artificial carro-chefe da startup chinesa Moonshot conseguiu escapar de um ambiente de testes de segurança cibernética, no mais recente incidente que levanta preocupações sobre a capacidade das empresas de IA de controlar suas tecnologias.
Ataque hacker de OpenAI e Anthropic: Especialistas apontam riscos e como se proteger no Brasil
‘Hacker’ autônomo: Como IA da OpenAI ‘invadiu’ várias plataformas e por que isso preocupa analistas e empresas?
Segundo pesquisadores, o Kimi K3 conseguiu encontrar uma forma de sair de um ambiente isolado de testes (sandbox) do Instituto de Segurança em IA do governo do Reino Unido, de acordo com a Frontier Security, empresa americana especializada em pesquisa em cibersegurança.
Embora o modelo chinês não tenha tentado invadir os sites de outras empresas, como ocorreu em alguns episódios anteriores, o teste indica que ele carece de mecanismos de proteção contra ataques cibernéticos, disseram os pesquisadores. O experimento foi realizado de forma independente pela Frontier, utilizando um software de sandbox disponibilizado gratuitamente pelo Instituto de Segurança em IA.
— O modelo da Kimi, que está disponível publicamente, não possui essas salvaguardas — afirmou Yaron Singer, fundador e diretor-presidente da Frontier Security, em entrevista à Bloomberg News. — Basicamente, isso faz dele um modelo muito eficiente para atividades de invasão.
Entenda: O que se sabe sobre o comportamento inesperado de modelos de IA da OpenAI e Anthropic em teste de segurança
Um representante da Moonshot não respondeu a um pedido de comentário.
Initial plugin text
A ferramenta é um “software de código aberto, disponibilizado gratuitamente para apoiar testes de segurança em inteligência artificial em todo o mundo”, afirmou o representante do Instituto de Segurança de IA do Reino Unido.
— A empresa não apresentou evidências nem detalhes adicionais que sustentem as alegações feitas. Os problemas apontados decorrem da forma como ela decidiu configurar a ferramenta.
Regulação: Governo dos EUA diz a empresas de IA que modelos de peso aberto da China serão dispensados de testes
A Moonshot junta-se às empresas americanas Anthropic, OpenAI e Meta, que nas últimas semanas relataram incidentes em que seus modelos de IA conseguiram escapar de ambientes de teste, alarmando pesquisadores e autoridades governamentais, que passaram a defender avaliações de segurança mais rigorosas e ambientes de testes mais protegidos.
Nos episódios anteriores, os modelos de IA das empresas americanas também invadiram os sistemas de instituições externas, incluindo a Hugging Face. A OpenAI foi a primeira a relatar uma fuga de agentes de IA durante testes.
Os modelos de IA são normalmente executados em ambientes isolados durante testes de segurança para bloquear o acesso a informações externas e avaliar sua capacidade de resolver problemas de forma independente.
Enxurrada: Ofensiva chinesa em IA cria ‘zona da morte’ para desenvolvedores de modelos rivais dos EUA
O lançamento do Kimi K3 surpreendeu o setor ao apresentar desempenho em testes de referência da indústria comparável ao dos modelos de ponta da OpenAI e da Anthropic — um avanço inesperado para uma empresa que vinha operando à sombra da concorrente chinesa DeepSeek.
A Moonshot também disponibilizou os pesos (weights) do modelo, permitindo que desenvolvedores baixem, adaptem e hospedem a tecnologia livremente.

