Um grupo clandestino que distribuía modelos de inteligência artificial com "jailbreak" acabou no radar da polícia chinesa depois que um dos usuários invadiu um site do governo e compartilhou imagens do ataque dentro da própria comunidade.
Invadir ilegalmente um sistema de informática é crime grave na China e pode resultar em pena de até três anos de prisão. Em casos considerados muito graves, a punição pode ser maior.
O caso envolveu um servidor privado usado para revender acesso a modelos de IA sem parte das proteções de segurança impostas pelas empresas responsáveis por essas tecnologias.
神了,有神人用破甲模型中转站拿 AI 攻击中国政府网站,最后把整个中转站都送走了。
今天看到好几个破甲模型站的群直接炸了。
这里解释一下什么叫「破甲模型站」。
简单来说,就是有人通过越狱提示词、修改 System Prompt 等方式,绕过或削弱开源、闭源模型原本的安全限制,再通过 API… pic.twitter.com/QthQj78itZ
— Max For AI (@MaxForAI) August 19, 2026
Grupo revendia acesso a modelos de IA com jailbreak
O chamado "jailbreak" consiste no uso de prompts, modificações de código ou outras técnicas para contornar mecanismos de segurança incorporados aos modelos de IA.
Essas barreiras existem, entre outros motivos, para impedir pedidos relacionados a ataques cibernéticos ou geração de códigos maliciosos.
Como empresas de IA proíbem esse tipo de prática, alguns usuários criam servidores privados de retransmissão de API.
Na prática, o responsável pelo serviço compra acesso oficial aos modelos, remove ou contorna determinadas proteções e revende esse acesso para um grupo fechado mediante pagamento.
Um dos usuários de uma dessas comunidades decidiu utilizar um modelo com jailbreak para procurar vulnerabilidades em um site com domínio ".gov.cn", usado por órgãos do governo chinês.
O invasor conseguiu obter acesso de "Super Admin" ao sistema de gerenciamento de conteúdo (CMS) do site. A partir daí, teve acesso aos dados de usuários, milhares de artigos e backups do banco de dados.
Os planos ainda incluíam a criação de uma porta de acesso escondida e permanente, conhecida como backdoor, que seria usada para continuar extraindo dados posteriormente.
Hacker mostrou invasão dentro do próprio grupo
Depois da invasão, o usuário publicou capturas de tela no chat privado da comunidade para mostrar o que havia conseguido fazer.
Outro integrante percebeu as possíveis consequências legais da ação e denunciou tanto a invasão quanto o grupo responsável pelo serviço de IA às autoridades chinesas de segurança cibernética.
A reação do administrador do servidor veio logo depois. As atividades comerciais foram interrompidas, e ele prometeu devolver o dinheiro dos usuários caso a polícia possibilitasse os reembolsos.
O chat do grupo também foi apagado em uma tentativa de destruir evidências. A situação acabou atingindo diretamente o negócio que vendia os modelos modificados.
O responsável pelo serviço aparentemente esperava que a IA sem as restrições convencionais fosse usada para prompts que normalmente seriam bloqueados ou para contornar limitações menores.
Um dos clientes, porém, utilizou o modelo em um ataque cibernético contra um site governamental e ainda publicou os resultados dentro da própria comunidade. A denúncia colocou todo o grupo sob risco de investigação e encerrou as atividades do servidor.
Caso amplia discussão sobre IA sem proteções de segurança
O episódio mostra como os riscos associados a modelos de IA sem mecanismos de segurança podem sair de cenários teóricos e chegar a ataques contra sistemas reais.
Nesse caso, um modelo sem as restrições convencionais foi usado durante uma invasão, enquanto as consequências chegaram aos responsáveis pelo serviço que distribuía o acesso.
A situação também se conecta às discussões recentes em torno do Claude Fable 5, modelo da classe Mythos desenvolvido pela Anthropic.
Em meados de 2026, preocupações com segurança nacional levaram o governo dos Estados Unidos a determinar restrições de acesso ao Fable 5 e ao Mythos 5, o que levou a Anthropic a suspender temporariamente os modelos para cumprir a ordem.
As preocupações estavam ligadas ao avanço das capacidades desses modelos em segurança cibernética e ao risco de contornar suas proteções. O Fable 5 voltou a ser disponibilizado depois da implementação de mecanismos adicionais de segurança.
Testes mencionados no contexto dessas discussões apontaram taxas de até 73% na conclusão de determinadas tarefas cibernéticas em modelos sem proteções equivalentes.
A própria Anthropic mantém classificadores específicos no Fable 5 para bloquear solicitações consideradas perigosas nessa área.








