Hvad selskabet sælger

Iværksættervirksomheden Abliteration.ai driver en hostet tjeneste, der giver kunder AI-modeller med åbne vægte, hvor sikkerhedstræningen er taget ud, skrev TechCrunch den 3. september. Brugerne når modellerne gennem en browser eller et API, uden at hente vægte eller leje grafikprocessorer, og kan lægge deres egen moderation ovenpå — eller lade være.

Blandt modellerne findes ændrede udgaver af førende udgivelser med åbne vægte, som Z.ais GLM-5.3. Selskabet gik i gang sidst i 2025 og blev registreret i marts 2026. Medstifteren, der kun oplyste fornavnet Devon, fordi han stadig er ansat et andet sted, sagde til TechCrunch, at Abliteration.ai ikke har risikovillig kapital, men har »flere aftaler med store cloududbydere«, og at der er finansieringssamtaler i gang.

Hvad abliteration er

Navnet er sat sammen af ablation og obliteration og beskriver et konkret fund om, hvordan alignmenttræning virker. Afvisningsadfærden i en finjusteret model synes ikke at være jævnt fordelt i netværket. Den samler sig i identificerbare retninger, der kan isoleres og dæmpes, mens resten af modellens evner i det store hele står tilbage.

Hænder der skriver på et tastatur med kode på skærmen
Tjenesten nås via browser eller API i stedet for ved at hente modelvægte. Arkivfoto. TREEDEO.ST · pexels · Pexels License

Derfor går teknikken hurtigt. Et klientnotat fra advokatfirmaet Akerman fra maj 2026, der gennemgår den offentliggjorte forskning, konstaterede, at det frie GitHub-værktøj Heretic kan fjerne beskyttelsen i Metas Llama 3.3 på under ti minutter på forbrugerhardware, og at Googles Gemma 4 blev ablitereret inden for 90 minutter efter udgivelsen. Notatet talte over 3.500 ændrede varianter med 13 millioner downloads tilsammen.

Intet af det er nyt. Det nye er, at det nu er et produkt med support, der skal passes, og et faktureringsforhold.

Forsvarernes argument

Devons tese er, at ucensurerede modeller hjælper dem, der forsvarer systemer, mere end dem, der angriber dem. »Fordelen er, at forsvarerne nu kan bevæge sig så hurtigt som muligt,« sagde han til TechCrunch. »Jeg tror, det vil sætte fart på cybersikkerheden.« Han oplyste, at de første kunder er red team-virksomheder i Storbritannien og Europa, hvis egne kunder er banker, flyselskaber og operatører af kritisk infrastruktur.

Argumentet hænger sammen, og det er det samme, der føres for offensivt sikkerhedsværktøj i almindelighed. Det har også et åbenlyst hul: intet ved et hostet endepunkt skiller et red team i en bank fra hvem som helst med et kort.

Indvendingen

Andrew Yoon, forskningschef i AI-sikkerhedsorganisationen CivAI, sagde til TechCrunch, at abliteration gør en model til »en sociopat«, og at han venter at se ablitererede modeller brugt til skade inden længe.

Et tomt mødelokale på et kontor med langbord og whiteboard
Selskabet oplyser, at de første kunder er red team-virksomheder, der arbejder for banker og flyselskaber. Arkivfoto. Max Vakhtbovych · pexels · Pexels License

Den dybere pointe i Akerman-notatet er den, tilsynsmyndighederne bliver nødt til at svare på: hvis alignment kan fjernes på ti minutter med et gratis værktøj, så er sikkerhedstræning en aftagelig funktion og ikke en strukturel egenskab ved modellen. Enhver sikkerhedsforpligtelse knyttet til en udgivelse med åbne vægte gælder artefaktet, som det leveres, ikke som det ser ud et døgn senere.

Spørgsmålet er allerede levende i Bruxelles og Washington, hvor behandlingen af modeller med åbne vægte under reglerne om systemisk risiko har været den mindst afklarede del af rammerne. Et selskab med prisliste gør det sværere at afvise abliteration som marginal forskningspraksis.

Værd at følge: om de cloududbydere, Devon siger han har aftaler med, beholder dem, når de bliver nævnt ved navn, og om en modeludgiver forsøger at gøre et licensvilkår gældende over for en hostet abliterationstjeneste. Ingen af delene er prøvet.