Del experimento mental a la hoja de ruta

La pregunta de si los sistemas de IA empezarán a mejorarse a sí mismos ha dejado de ser hipotética y ha empezado a aparecer en los planes de las empresas con fechas puestas, informó Fortune el sábado.

OpenAI ha desplegado lo que llama un becario de investigación automatizado, un sistema que según la compañía completa tareas que a un investigador humano cualificado le llevarían unos días. La empresa apunta a marzo de 2028 para un investigador de IA plenamente automatizado. También ha declarado que todavía no sabe cómo alcanzar con seguridad una automejora recursiva completa y alineada, y que no puede dar por hecho que los avances en alineación y seguridad vayan al mismo ritmo que los de capacidad.

Es un par de afirmaciones inusual de publicar junto: una fecha objetivo para una capacidad y el reconocimiento de que el problema de seguridad asociado sigue sin resolver.

Dos personas conversando a ambos lados de una mesa de reuniones
Ilustración: Anthropic dice que pausaría si sus rivales lo hicieran de forma verificable. Mikhail Nilov · pexels · Pexels License

Laboratorios distintos, destinos distintos

Elon Musk ha descrito la posición de xAI de otro modo. Los humanos participan cada vez menos en la mejora de Grok, ha dicho, con cada modelo sucesivo construido por el anterior, y la empresa aspira a la automatización completa a más tardar a finales de 2027.

Anthropic se sitúa entre ambos. La compañía afirma que Claude dirige ya cerca de una cuarta parte de su investigación y desarrollo de modelos y puede llevar trabajo técnico complejo de principio a fin desde una instrucción general bajo supervisión humana, mientras defiende por separado moderar el ritmo y dice que frenaría o pausaría su propio trabajo si los competidores hicieran lo mismo de forma verificable.

Mustafa Suleyman, de Microsoft, ha planteado el objetivo como una superinteligencia humanista: sistemas con altos grados de autonomía que permanezcan, en su formulación, calibrados y dentro de límites. Es una afirmación sobre dónde debe estar la frontera, no sobre cuándo se alcanzará.

Un calendario de pared con fechas marcadas
Ilustración: OpenAI apunta a marzo de 2028 para un investigador plenamente automatizado. K · pexels · Pexels License

La objeción y el matiz

Anthony Aguirre, presidente del Future of Life Institute y profesor de física en la Universidad de California en Santa Cruz, dijo a Fortune que la autonomía completa es “probablemente la peor idea de la historia de la humanidad”.

John Thickstun, profesor de informática en Cornell, aportó el matiz desde el otro lado: la IA lleva años ayudando a construir IA en papeles de apoyo, y la línea entre un asistente de investigación útil y un sistema que se automejora se traza por grado, no por naturaleza.

Ambas cosas son ciertas a la vez, y eso es lo que hace difícil leer las fechas. Un investigador automatizado que cierra un bucle que hoy cierran los humanos es una continuación de la práctica existente. Uno que fija su propia agenda de investigación no lo es. Los calendarios de las empresas no siempre distinguen entre los dos.

Qué vigilar

La cifra concreta que conviene seguir es el objetivo de marzo de 2028 de OpenAI, porque es la única ligada a un artefacto definido y no a una tendencia. La segunda es si los laboratorios publican las evaluaciones con las que deciden que un sistema ha pasado de asistente a investigador autónomo: el umbral que haría comprobable desde fuera cualquiera de estas fechas.