IA en un minutoNoticiasModelos
OpenAI publica 722 manuscritos matemáticos de un modelo interno que aún no ha lanzado
Redacción de IA en un minuto · Editor: Jon Elgezabal
En 30 segundos
OpenAI ha sacado a la luz 722 manuscritos de matemáticas escritos por un modelo propio que sigue sin estar disponible, ordenados en 372 familias dentro de GitHub. Según OpenAI, el modelo partió de unos 4.000 problemas y de media cada resultado consumió lo mismo que unas tres horas de ChatGPT Pro. Muchos trabajos se pueden verificar en Lean, aunque no todos, y los asesores del Institute for Advanced Study lo ven como un hito sin avalar el proceso.
OpenAI ha publicado 722 manuscritos matemáticos generados por un modelo interno que todavía no ha lanzado.
Los ha agrupado en 372 familias y los ha subido a un repositorio público de GitHub. Según la empresa, al modelo se le plantearon unos 4.000 problemas, y cada resultado necesitó de media un cálculo equivalente a unas tres horas de razonamiento de ChatGPT Pro, el modo Pro de su asistente. Muchos manuscritos tienen formalizaciones en Lean, un lenguaje que permite comprobar demostraciones por ordenador, pero no todos, y OpenAI avisa de que algunos resultados sin formalizar podrían tener problemas.
El grupo asesor de matemáticas e IA del Institute for Advanced Study, al que OpenAI consultó, lo ha calificado de acontecimiento importante para las matemáticas, pero aclara que su papel no es un juicio sobre el impacto de los resultados ni un aval del proceso con el que se obtuvieron.
Por qué importa · análisis y opinión
¿Cuántos de esos resultados son correctos? OpenAI no lo sabe del todo, y lo dice: los formalizados en Lean se pueden comprobar por ordenador, pero el resto podría tener errores. Esa franqueza marca lo que falta para que esto salga del laboratorio. Primero, un modelo disponible, porque el que los produjo es interno. Segundo, matemáticos que juzguen si los resultados importan, algo que el grupo asesor del Institute for Advanced Study evita hacer expresamente. Y tercero, un coste asumible, porque cada resultado consumió mucho cálculo. Hasta entonces, es una demostración de capacidad más que una herramienta que un investigador pueda usar mañana.
Fuente oficial: OpenAI · Redactada con ayuda de IA: cómo hacemos las noticias



