Vad han sade

Jacob Coxon, forskare som ägnat omkring tre år åt förträning på OpenAI och därefter på Anthropic, meddelade sin avgång den 9 september i ett inlägg på X och sade att han lämnar AI-branschen helt.

Han skrev att han avgått från Anthropic samma dag, att inget av bolagen agerar ansvarsfullt och att de kapplöper rakt mot en självförbättrande superintelligens och spelar med våra liv. Han sade att branschen är på väg mot de mest aggressiva scenarierna, där saker kan vara utom kontroll redan i slutet av nästa år, och att acceptera kapplöpningen och gå in i det han kallade slutspelet är en övermodig chansning som inte borde inledas från ett privat bolags Slack.

The Wall Street Journal rapporterade om avgången. Anthropic har inte publicerat något svar.

Skillnaden han gör mellan de två labben

Det mer intressanta i Coxons argument är att han inte behandlar bolagen som likvärdiga. På OpenAI har forskarna, som han beskriver det, inte fullt ut tagit in vad som står på spel. På Anthropic har de det — ledningen förstår riskerna — men bolaget är fast i en konkurrenskapplöpning och tror att ingen annan kommer att agera ansvarsfullt, och därför måste det komma först.

En whiteboard täckt av diagram i ett mötesrum
Han arbetade med förträningsforskning på OpenAI och därefter på Anthropic. Illustrativ bild. Christina Morillo · pexels · Pexels License

Det är en skarpare kritik än den vanliga, eftersom den medger säkerhetsargumentet i stället för att bestrida det. Om ett bolag kan förstå en risk klart och ändå inte bromsa är problemet strukturellt snarare än kunskapsmässigt, och intern säkerhetskultur är inte den spak som åtgärdar det.

Vad han begär

Coxon efterlyser samordning mellan labben och säger att den bör sträcka sig till kostsamma åtgärder — uttryckligen inklusive ett tillfälligt förbud mot att förbättra modellernas förmågor. Det är en betydligt starkare begäran än de ramverk för offentliggörande och utvärderingsåtaganden branschen samlats kring, och den saknar mekanism.

En person som går genom en glasad kontorskorridor
Han efterlyste samordning mellan labben, inklusive en tillfällig paus i förmågeökningar. Illustrativ bild. cottonbro studio · pexels · Pexels License

Den landar dessutom en vecka då samma argument framförts inifrån det andra labbet. OpenAI:s forskningschef Jakub Pachocki skrev förra veckan att inget labb har löst inriktningsproblemet väl nog för att fortsätta skala för fullt. Skillnaden är att Pachocki sade det medan bolaget fortsatte skala, vilket ligger nära det Coxon påpekar.

Hur mycket vikt det bör ges

En forskares avgång är inget bevis om modellers förmågor, och en avgående anställd har inte mer tillgång till framtiden än någon annan. Det är däremot ett belägg för vad människor inne i dessa bolag tror, och det har betydelse för hur allvarligt man ska läsa de säkerhetsramverk de publicerar.

Kategorin är liten men inte tom: flera forskare har lämnat frontlaboratorier offentligt de senaste två åren med varianter av samma argument. Ingen har ändrat en lanseringsplan.

Vad som är värt att följa

Om Anthropic svarar, och i vilken ton. Ett bolag som byggt sin marknadsposition på att ta säkerhet på allvar står inför ett obekvämt val när kritiken kommer från någon som arbetat i dess förträningsstack och inte bestrider dess analys, bara dess handlande.