02 · OpenAI
OpenAI guarda en un cajón la IA que resolvió 722 problemas de matemáticas

OpenAI ha publicado 722 manuscritos matemáticos producidos por un modelo interno que no comercializa, agrupados en 372 familias y con un coste medio de tres horas de su versión más potente por resultado; buena parte ha pasado un comprobador formal, aunque no todos.
Por qué importa
La capacidad del modelo para producir resultados en horas desplaza el cuello de botella desde generar teoremas hacia interpretarlos y decidir cuáles merecen atención humana. Ese giro tensiona la revisión por pares, la asignación de crédito y la formación de investigadores, porque la producción matemática escalaría con el cómputo disponible. Y si la matemática se parte en una capa máquina verificable y otra humana comprimida, serán las revistas, los departamentos y los propios matemáticos quienes deban reaccionar. La incógnita es cuántos de esos manuscritos superan la comprobación exhaustiva.
Los detalles
- Los trabajos cubren teoría de números, teoría de la complejidad y física matemática, y cada manuscrito habría consumido de media el equivalente a tres horas de razonamiento de ChatGPT Pro, según estimaciones de la propia empresa.
- El científico Derya Unutmaz sostiene que el conjunto representa el 81% de los principales descubrimientos matemáticos publicados en los últimos tres años, pero esa cifra es una estimación y no una revisión independiente, y no todos los resultados han superado la verificación en Lean.
- El matemático Steve Hsu plantea separar una matemática generada y consumida por máquinas, masiva y verificable, de una matemática humana reducida a una teoría comprimida de ese frente automatizado.