La déclaration

L’Association for Human Mathematics a publié le 7 octobre une déclaration, hébergée en billet invité sur le blog de Terence Tao, appelant les mathématiciens à cesser de collaborer avec OpenAI.

Sa phrase centrale porte sur le volume plus que sur le contenu. Publier plus de 700 fichiers d’un coup “n’est pas une démonstration d’érudition, mais une démonstration de pouvoir”, écrit le groupe. Il ajoute que “les mathématiciens n’ont pas demandé que ce travail soit fait”, rejette l’idée que la publication fasse avancer la discipline et exhorte “les mathématiciens à interrompre leur travail avec OpenAI”. La déclaration note aussi qu’OpenAI se défend dans des procès pour plagiat présumé, contrefaçon et dilution de marque.

Tao n’a ajouté aucune opinion. Ses seuls mots sont une note éditoriale signalant un billet invité et indiquant que le texte a été converti depuis un autre format de fichier à l’aide de l’IA.

Ce qu’OpenAI a publié, et ce qui est tombé

OpenAI a publié le 6 octobre 722 prépublications dans un dépôt GitHub, portant sur des avancées revendiquées sur 372 problèmes de mathématiques en géométrie, informatique, algèbre et d’autres domaines, produites par un modèle interne qu’elle n’a pas diffusé.

Un jour plus tard, elle a retiré trois manuscrits pour une erreur de signe, a rapporté Retraction Watch. L’erreur invalidait un argument d’un manuscrit ainsi que la construction sur laquelle s’appuyaient deux travaux dépendants. OpenAI a aussi révisé 14 autres manuscrits : réparations de preuves, énoncés corrigés, hypothèses et dépendances clarifiées, et une citation obsolète corrigée. Le catalogue affiche désormais 719 textes.

Un amphithéâtre avec des rangées de sièges bleus vides
Le groupe dit que les mathématiciens n'ont pas demandé ce travail. Photographie d'illustration. DOAN THANH BINH · pexels · Pexels License

Une erreur, trois articles

La forme de la défaillance est ce qui mérite attention. Une seule erreur de signe n’est pas restée dans un document. Elle s’est propagée à deux autres bâtis sur la même construction, ce qui arrive quand un vaste corpus est produit d’un coup par un système qui réutilise ses propres résultats intermédiaires.

Les mathématiques humaines ont la même structure de dépendances. Ce qu’elles n’ont pas d’ordinaire, ce sont 722 documents arrivant le même jour sans qu’aucun relecteur n’en ait lu un seul.

Tout le monde n’est pas d’accord

L’Advisory Group on Mathematics and Artificial Intelligence adopte une ligne plus mesurée et traite la publication comme un premier pas dont le contenu mathématique commence seulement à être compris. Le mathématicien de Cornell Alex Townsend a dit que les erreurs n’étaient pas surprenantes et qu’il en soupçonne d’autres, estimant qu’OpenAI aurait dû annoncer d’abord les manuscrits formellement vérifiés.

C’est une critique de méthode plutôt qu’un boycott, et elle pointe le même problème : la publication a été ordonnée par la quantité, pas par la confiance.

Des rangées de vieux livres reliés en cuir sur une étagère en bois
Les 719 manuscrits restent publics dans un dépôt GitHub. Photographie d'illustration. T6 Adventures · pexels · Pexels License

À surveiller

Le taux de retrait. OpenAI a donné à la discipline un corpus public et numéroté ainsi qu’un journal de corrections public, ce qui rend mesurable la proportion des 719 qui survit à l’examen — ce que presque aucune affirmation du secteur ne permet. Trois retirés et quatorze révisés le premier jour, c’est le premier point de données, pas le dernier.