Un preprint publicado en arXiv el 2 de septiembre afirma haber logrado el primer sistema de IA que supera al mejor competidor humano en un conjunto de problemas de la Olimpiada Internacional de Informática.

Las cifras

En la IOI 2026, los autores declaran que su sistema específico para la competición obtuvo 535,4 puntos sobre 600, frente a un umbral de oro de 361,12 y una mejor puntuación humana de 498,27.

Sobre el conjunto de problemas de 2025, el menor de los dos modelos —Nemotron-3-Nano-CC, de 30.000 millones de parámetros con 3.000 millones activos— pasó de 130 a 468 puntos al aplicar una estrategia en tiempo de inferencia que los autores llaman GenCorrect. El umbral de oro ese año era 438,3. El mayor, Nemotron-3-Ultra-CC, de 550.000 millones con 55.000 millones activos, obtuvo 502.

Una pizarra cubierta de ecuaciones matemáticas.
GenCorrect se aplica en inferencia y no en entrenamiento, y explica la mayor parte de la mejora del modelo pequeño. cottonbro studio · pexels · Pexels License

Cómo se construyó

La cadena combina problemas curados, trazas de razonamiento sintéticas, ajuste fino supervisado y aprendizaje por refuerzo sobre un conjunto de 22.000 problemas. GenCorrect se aplica en inferencia y no durante el entrenamiento, que es de donde procede la mayor parte de la mejora del modelo Nano: pasar de 130 a 468 no es un modelo mejor, es una forma mejor de usar el mismo.

Las advertencias que trae el propio trabajo

Es un preprint. No ha sido revisado por pares y los resultados no se han reproducido de forma independiente.

La cifra de la IOI 2026 procede de lo que los autores describen como un sistema específico para la competición y no de un modelo general, lo que hace la comparación con un competidor humano menos directa de lo que sugiere el titular. Quien concursa se examina en condiciones fijas; un sistema afinado para ese examen es otra clase de participante.

Una persona escribiendo en un portátil de noche en un escritorio.
El trabajo es un preprint: sin revisión por pares y sin reproducción independiente. Faye Tsui · pexels · Pexels License

Lo que sí dice

Que un modelo de 30.000 millones de parámetros con 3.000 millones activos pueda superar un umbral de oro solo mediante técnica en tiempo de inferencia es el resultado más duradero, y el que menos depende de cómo se plantee la comparación humana.

Qué vigilar

Si la propia IOI se pronuncia. La programación competitiva ha tratado hasta ahora a los participantes de IA de forma informal, y afirmar que se ha superado al mejor humano es de esas cosas que obligan a escribir una regla.