O que veio a público na quinta-feira

Uma versão em grande medida sem ocultações da peça de julgamento sumário do New York Times contra a OpenAI e a Microsoft foi desselada a 17 de setembro no Distrito Sul de Nova Iorque. Integra um conjunto de requerimentos opostos — a OpenAI apresentou o seu a 4 de setembro — e a decisão pode afastar alguns pedidos ou reduzir aquilo que um júri teria de decidir.

A peça conta menos pela argumentação jurídica do que pelo que junta ao processo público: mensagens internas de dentro das duas rés, escritas anos antes do caso, que o Times usa para sustentar que as empresas sabiam o que faziam.

O memorando da Microsoft

A citação que mais circulou vem de Brent Hecht, diretor de ciência aplicada da Microsoft. Num memorando interno de janeiro de 2023, noticiado pela TechCrunch e por outros a partir da peça desselada, descreveu a prática como um roubo espantoso de proporções sem precedentes e como o maior roubo de trabalho da história da humanidade.

É a opinião de um trabalhador num memorando, não uma posição da empresa, e a Microsoft não disse que fosse política sua. Mas é o tipo de documento que uma ré dificilmente afasta, porque mostra que a pergunta foi feita dentro de casa e respondida nesses termos.

Uma pilha de documentos impressos numa secretária
A peça desselada junta ao processo público mensagens internas das duas empresas. Fotografia ilustrativa. cottonbro studio · pexels · Pexels License

As mensagens da OpenAI

A peça cita também Nick Turley, responsável pelo ChatGPT, que descreve o produto como uma ameaça existencial para os editores e como largamente substitutivo do seu trabalho, com a substituição a aumentar à medida que os modelos melhoram. Ao presidente da OpenAI, Greg Brockman, é atribuída a frase de que os modelos são excelentes em notícias.

São essas as frases de que o Times precisa. Uma defesa de uso legítimo assenta em boa parte no efeito de mercado — se a nova obra desloca a procura pela original — e declarações internas de que o produto substitui os editores colidem diretamente com a posição das empresas.

A escala alegada

Segundo o Times, foi extraído conteúdo de mais de 10 milhões de artigos, quase um terço dos quais só do próprio Times. A peça descreve ainda o contorno de paywalls e a remoção de informação de gestão de direitos de autor dos dados de treino, esta última um pedido autónomo no direito norte-americano, distinto da violação em si.

Uma pilha de jornais dobrados
O Times afirma que foi extraído conteúdo de mais de 10 milhões de artigos. Fotografia ilustrativa. Mike van Schoonderwalt · pexels · Pexels License

Nada disso foi testado em julgamento. São as qualificações da autora sobre documentos obtidos na fase de instrução, juntas em apoio do seu próprio requerimento.

Porquê este caso em particular

O Times processou a OpenAI e a Microsoft em dezembro de 2023. É o mais avançado dos grandes casos de editores de notícias, envolve a maior empresa de IA a par do seu maior investidor, e a fase de julgamento sumário é aquela em que uma decisão sobre uso legítimo seria tomada em vez de apenas discutida.

Uma decisão favorável ao Times quanto à responsabilidade reescreveria as negociações de licenciamento que qualquer editor mantém. Uma decisão favorável à OpenAI sobre uso legítimo faria o mesmo em sentido contrário.

O que observar

A decisão do tribunal sobre os requerimentos opostos, e se enfrenta o uso legítimo de frente ou o remete para julgamento. A ação paralela da Authors Guild viu as suas peças desseladas ao mesmo tempo, pelo que ambas podem agora ser lidas na íntegra.