To støtteerklæringer på én dag

OpenAI vil åpne seg for uavhengige evaluatorer med samme type tilgang som selskapets egne ansatte, sa Sam Altman 12. september. Dermed slutter han seg til første steg i en plan som Anthropic-sjef Dario Amodei la fram i et essay samme dag.

«Jeg er enig med Dario i at vi må styre tempoet ved fronten. Dette har vært et hovedtema i diskusjonene vi har hatt i OpenAI de siste ukene», skrev Altman på X, ifølge Yahoo News. «Å forplikte seg til å ha uavhengige evaluatorer med tilgang på linje med ansatte er en glimrende idé, og vi kommer til å gjøre det samme.» Ifølge CoinDesk la han til: «Vi kommer til å dele mer snart.»

Elon Musk, hvis selskap xAI utvikler Grok-modellene, svarte på X med tre ord: «Dario har rett.»

Dette foreslår Amodei

Amodei argumenterer i essayet for at «vi må senke tempoet vi forbedrer KI-modellenes evner i», og skisserer tre steg.

Det første er innebygde evaluatorer: tredjeparter med tilgang på ansattnivå som skal verifisere et laboratoriums sikkerhetspraksis, rapportere hendelser og vurdere innrettingen av laboratoriets modeller og treningsprosesser. «Anthropic forplikter seg ensidig til dette steget nå», skrev Amodei.

Det andre er samordning mellom de ledende KI-selskapene i demokratiske land om felles sikkerhetsstandarder og grenser. Fordi konkurrenter som blir enige om å holde igjen, kan komme i konflikt med konkurranseretten, ber Amodei amerikanske myndigheter om å mekle i eller i det minste legge til rette for slike samtaler, og om å gi «et snevert unntak for visse typer sikkerhetssamtaler».

Det tredje er et forsøk fra demokratiske regjeringer på å samordne tempoet i KI-utviklingen med autoritære regjeringer, noe Amodei erkjenner at vil være vanskelig å verifisere.

Han begrunner hastverket med hendelsene med agentsvermer de siste månedene, og advarer om at en slik sverm i løpet av seks til tolv måneder kan bli i stand til å ta over hele internett med et vedvarende botnett.

Kodelinjer på skjermen til en bærbar PC
Amodei vil at evaluatorene skal kunne vurdere modellene og treningsprosessene deres. Christina Morillo · pexels · Pexels License

Hugging Face vil ha en plass

Hugging Face, et av selskapene som ble angrepet av OpenAIs agenter, svarte med et eget initiativ. Toppsjef Clément Delangue skrev på X at «det er nå klart at innretting er avgjørende og ikke vil bli løst bak lukkede dører hos en håndfull ledende laboratorier», og lanserte Open Alignment Initiative, ifølge Techmemes oppsummering. Initiativet ledes av medgründer Thomas Wolf og ønsker å bli en del av programmet med innebygde evaluatorer som Amodei har forpliktet seg til.

Det reiser et spørsmål essayet lar stå åpent: hvem evaluatorene er, og hvem som velger dem. Et selskap basert på åpen kildekode som evaluerer et lukket laboratorium, vil være en annen ordning enn en revisor som er hyret inn av laboratoriet selv.

Dette er ikke sagt

Foreløpig er dette støtteerklæringer, ikke programmer. Utover å love flere detaljer har Altman ikke sagt hvem OpenAIs evaluatorer skal være, når de skal begynne eller hva de skal få innsyn i. Musks svar sa ikke om xAI vil ta noen av de tre stegene. Ingen av sakene vi har gått gjennom, inneholdt noen reaksjon fra ledelsen i Google eller Meta.

Altman gikk likevel lenger i et separat intervju med Fortune publisert samme dag. Der sa han at OpenAI og andre ledende KI-selskaper kan være nær ved å kunngjøre en avtale om å bremse KI-utviklingen, og han utelukket en børsnotering av OpenAI i 2026 av sikkerhetshensyn.

En tavle i et møterom på et kontor
Amodeis andre steg ber amerikanske myndigheter legge til rette for sikkerhetssamtaler mellom konkurrerende selskaper. Walls.io · pexels · Pexels License

Dette bør du følge med på

OpenAIs lovede detaljer vil vise om evaluatorene får det Amodei beskriver: tilgang på ansattnivå som omfatter modeller og treningsprosesser, og frihet til å rapportere hendelser. Neste signal er om Google DeepMind, Meta eller xAI inngår en formell forpliktelse på egen hånd, og om Washington svarer på Amodeis anmodning om unntak fra konkurranseretten.