Två stödförklaringar på en dag

OpenAI kommer att öppna sig för oberoende granskare med samma slags tillgång som den egna personalen, sade Sam Altman den 12 september. Därmed ansluter sig OpenAI till det första steget i en plan som Anthropics vd Dario Amodei lade fram i en essä samma dag.

”Jag håller med Dario om att vi måste reglera tempot vid fronten. Det har varit ett av huvudämnena i de diskussioner vi har haft på OpenAI de senaste veckorna”, skrev Altman på X, enligt Yahoo News. ”Att förbinda sig att ha oberoende granskare med tillgång som anställda är en utmärkt idé, och vi kommer att göra detsamma.” Enligt CoinDesk tillade han: ”Vi kommer att ha mer att berätta snart.”

Elon Musk, vars bolag xAI utvecklar Grok-modellerna, svarade på X med tre ord: ”Dario har rätt.”

Vad Amodei föreslog

Amodei hävdar i sin essä att ”vi måste sakta ner takten i hur vi förbättrar AI-modellernas förmågor” och lägger fram tre steg.

Det första är inbäddade granskare: tredje parter med tillgång på anställdnivå som kontrollerar ett labbs säkerhetsrutiner, rapporterar incidenter och bedömer alignment hos dess modeller och träningsflöden. ”Anthropic förbinder sig ensidigt till detta steg redan nu”, skrev Amodei.

Det andra är samordning mellan de ledande AI-bolagen i demokratier kring gemensamma säkerhetsstandarder och gränser. Eftersom en överenskommelse mellan konkurrenter om att hålla igen kan strida mot konkurrenslagstiftningen ber Amodei USA:s regering att medla i, eller åtminstone möjliggöra, sådana samtal och att bevilja ”ett snävt undantag för vissa typer av säkerhetssamtal”.

Det tredje är ett försök från demokratiska regeringar att samordna takten i AI-utvecklingen med auktoritära regeringar, något Amodei medger skulle vara svårt att verifiera.

Han motiverar brådskan med de senaste månadernas incidenter med agentsvärmar och varnar för att en sådan svärm inom sex till tolv månader skulle kunna ta över hela internet med ett ihållande botnät.

Kodrader på skärmen till en bärbar dator
Amodei vill att granskarna ska kunna bedöma modellerna och deras träningsflöden. Christina Morillo · pexels · Pexels License

Hugging Face vill ha en plats

Hugging Face, ett av de bolag som angreps av OpenAI:s agenter, svarade med ett eget initiativ. Vd:n Clément Delangue skrev på X att ”det står nu klart att alignment är avgörande och inte kommer att lösas bakom stängda dörrar hos en handfull ledande AI-labb”, och tillkännagav Open Alignment Initiative, enligt Techmemes sammanfattning. Initiativet leds av medgrundaren Thomas Wolf och vill vara med i det program med inbäddade granskare som Amodei har förbundit sig till.

Det väcker en fråga som essän lämnar öppen: vilka granskarna är och vem som väljer ut dem. Ett bolag som bygger på öppen källkod och granskar ett slutet labb vore en annan ordning än en revisor som labbet självt har anlitat.

Det som inte har sagts

Än så länge handlar det om stödförklaringar, inte program. Altman har inte sagt vilka OpenAI:s granskare skulle vara, när de skulle börja eller vad de skulle få se, utöver att utlova fler detaljer. Musks svar sade inget om huruvida xAI tänker ta något av de tre stegen. Ingen av de rapporter vi har gått igenom innehöll någon kommentar från ledningen för Google eller Meta.

Altman gick dock längre i en separat intervju med Fortune som publicerades samma dag. Han sade att OpenAI och andra ledande AI-bolag kan vara nära att tillkännage en pakt för att bromsa AI-utvecklingen, och uteslöt en börsnotering av OpenAI 2026 av säkerhetsskäl.

En whiteboardtavla i ett mötesrum på ett kontor
I Amodeis andra steg uppmanas USA:s regering att möjliggöra säkerhetssamtal mellan konkurrerande bolag. Walls.io · pexels · Pexels License

Att hålla ögonen på

OpenAI:s utlovade detaljer kommer att visa om dess granskare får det Amodei beskriver: tillgång på anställdnivå som omfattar modeller och träningsflöden, och frihet att rapportera incidenter. Nästa signal är om Google DeepMind, Meta eller xAI gör ett eget formellt åtagande, och om Washington svarar på Amodeis begäran om undantag från konkurrenslagstiftningen.