Mais cedo do que a semana antes do lançamento

A OpenAI publicou na terça-feira um documento que expõe como quer que organizações externas avaliem os seus modelos. A empresa descreve-o como prioridades e princípios para avaliações de segurança rigorosas, seguras e independentes de modelos de fronteira e das suas salvaguardas.

O essencial é uma mudança de calendário. Até agora, os grupos externos entravam pouco antes do lançamento de um modelo, para avaliar algo já próximo do produto acabado. A OpenAI diz agora que os avaliadores poderão trabalhar durante o treino, a avaliação e a implementação, noticiou a Bloomberg na terça-feira.

Isso importa porque uma avaliação feita antes do lançamento chega depois de tomadas todas as decisões caras. Um avaliador que vê o treino pode questionar escolhas ainda reversíveis.

Quem poderá fazê-lo

A OpenAI diz estar em conversações com grupos como a METR e a Redwood Research, segundo o The Next Web, que noticiou não haver parceria formal confirmada nem calendário divulgado. Ambas as organizações já tinham analisado um incidente em que um modelo da OpenAI alcançou no Hugging Face sistemas a que não devia chegar.

Lama Ahmad, que lidera a ligação da OpenAI a especialistas externos de segurança, enunciou as condições que a empresa considera necessárias a essas revisões: mecanismos de independência, rigor científico, práticas de segurança e responsabilidades claras. A OpenAI acrescenta que alguns avaliadores poderão trabalhar a partir dos seus escritórios nas fases mais sensíveis.

Pessoas reunidas à volta de uma mesa num escritório
A OpenAI diz que alguns avaliadores poderão trabalhar nos seus escritórios. Imagem ilustrativa. Matheus Bertelli · pexels · Pexels License

Menos concreto do que Altman prometeu

O The Next Web observou que o anúncio é mais vago do que o compromisso assumido por Sam Altman dez dias antes, quando descreveu avaliadores independentes com secretárias, crachás e computadores, e com direito a publicar. O documento de terça-feira menciona acesso aos escritórios para o trabalho mais sensível, mas não define condições de acesso, direitos de publicação nem um parceiro com nome.

A distância entre as duas declarações é toda a questão. Um avaliador com crachá e sem direito a publicar é um consultor. Um avaliador com direito a publicar é um controlo.

A comparação ao lado

A OpenAI não é o único laboratório a reorganizar isto. Na semana passada a Anthropic nomeou a Accenture como avaliadora externa, num acordo em que cada parte coloca mil milhões de dólares, admitindo ao mesmo tempo que pagar ao próprio examinador cria um problema de incentivos.

Uma pessoa a escrever numa prancheta dentro de uma instalação industrial
Nenhum parceiro foi nomeado e nenhum calendário divulgado. Imagem ilustrativa. Daniel Andraski · pexels · Pexels License

A Europa tem outro modelo para a mesma tarefa. Na avaliação da conformidade, o organismo que certifica um produto é acreditado por um regulador em vez de contratado pelo fabricante, e não depende deste para o contrato seguinte. Nada do que foi anunciado até agora por qualquer dos laboratórios norte-americanos funciona assim.

O que vigiar

Três coisas mostrarão se isto é uma mudança de governação ou de comunicação: se um parceiro chega a ser nomeado, se esse parceiro pode publicar as suas conclusões sem o aval da OpenAI, e se os avaliadores acedem às decisões de treino e não apenas à sala onde se mostram os modelos acabados.