O que a empresa vende

Uma empresa em fase inicial chamada Abliteration.ai mantém um serviço alojado que entrega aos clientes modelos de IA de pesos abertos com o treino de segurança retirado, noticiou a TechCrunch a 3 de setembro. Os utilizadores chegam aos modelos através de um navegador ou de uma API, sem descarregar pesos nem alugar GPU, e podem acrescentar moderação própria por cima — ou não.

Entre os modelos disponibilizados estão versões modificadas de lançamentos de pesos abertos de topo, como o GLM-5.3 da Z.ai. A empresa arrancou no final de 2025 e foi constituída em março de 2026. O cofundador, que deu apenas o primeiro nome, Devon, por continuar empregado noutro lado, disse à TechCrunch que a Abliteration.ai não tem capital de risco mas tem “vários acordos com grandes fornecedores de nuvem”, estando conversas de financiamento em curso.

O que é a abliteração

O nome junta ablação e obliteração, e descreve uma constatação concreta sobre como funciona o treino de alinhamento. O comportamento de recusa num modelo afinado não parece estar distribuído de forma uniforme pela rede: concentra-se em direções identificáveis que podem ser isoladas e suprimidas, deixando praticamente intactas as restantes capacidades.

Mãos a escrever no teclado de um portátil com código no ecrã
O serviço é alcançado por navegador ou API, em vez de descarregar os pesos do modelo. Fotografia de arquivo. TREEDEO.ST · pexels · Pexels License

É por isso que a técnica é rápida. Uma nota a clientes da sociedade de advogados Akerman, de maio de 2026, que revê a literatura publicada, referia que a ferramenta gratuita do GitHub Heretic consegue retirar as proteções do Llama 3.3 da Meta em menos de dez minutos em hardware de consumo, e que o Gemma 4 da Google foi ablitrado 90 minutos depois de sair. A nota contabilizava mais de 3500 variantes modificadas com 13 milhões de descarregamentos acumulados.

Nada disso é novo. O que é novo é que passou a ser um produto, com apoio a prestar e uma relação de faturação.

O argumento dos defensores

A tese de Devon é que os modelos sem censura ajudam mais quem defende sistemas do que quem os ataca. “A vantagem é que agora os defensores podem mover-se o mais depressa possível”, disse à TechCrunch. “Acho que vai acelerar a cibersegurança.” Afirmou que os primeiros clientes são empresas de red teaming no Reino Unido e na Europa cujos clientes são bancos, companhias aéreas e operadores de infraestruturas críticas.

É um argumento coerente, e é o mesmo que se faz para as ferramentas de segurança ofensiva em geral. Também tem um buraco evidente: nada num ponto de acesso alojado distingue um red teamer de um banco de qualquer outra pessoa com um cartão.

A objeção

Andrew Yoon, diretor de investigação da organização sem fins lucrativos CivAI, dedicada à segurança da IA, disse à TechCrunch que a abliteração transforma um modelo num “sociopata” e que espera ver modelos ablitrados a serem usados para causar dano em breve.

Uma sala de reuniões de escritório vazia com uma mesa comprida e um quadro branco
A empresa diz que os primeiros clientes são firmas de red teaming a trabalhar para bancos e companhias aéreas. Fotografia de arquivo. Max Vakhtbovych · pexels · Pexels License

O ponto de fundo da nota da Akerman é aquele a que os reguladores terão de responder: se o alinhamento pode ser retirado em dez minutos com uma ferramenta gratuita, então o treino de segurança é uma funcionalidade amovível e não uma propriedade estrutural do modelo. Cada compromisso de segurança associado a um lançamento de pesos abertos é um compromisso sobre o artefacto tal como é entregue, não sobre o artefacto tal como existirá um dia depois.

A questão já está viva em Bruxelas e em Washington, onde o tratamento dos modelos de pesos abertos ao abrigo das regras de risco sistémico tem sido a parte menos resolvida dos enquadramentos. Uma empresa com tabela de preços torna mais difícil tratar a abliteração como uma prática marginal de investigação.

A acompanhar: se os fornecedores de nuvem com quem Devon diz ter acordos os mantêm depois de nomeados, e se algum editor de modelos tenta fazer valer uma cláusula de licença contra um serviço alojado de abliteração. Nenhuma das duas coisas foi testada.