Resumen:
El profesor de matemáticas de la Universidad de Nueva York, Tristan Buckmaster, anunció tres pruebas el martes, incluido un resultado preliminar que apunta a un importante problema sin resolver en matemáticas teóricas. También acusó a OpenAI de obtener información relevante sobre el progreso antes de que su investigación se hiciera pública y aprovechó sus enormes recursos informáticos para publicar primero una prueba completa.

Los problemas de existencia y suavidad de Navier-Stokes involucrados esta vez son uno de los siete "Problemas del Premio del Milenio" establecidos por el Clay Mathematics Institute, con una recompensa de 1 millón de dólares. La ecuación de Navier-Stokes se utiliza ampliamente en mecánica de fluidos, pero la investigación teórica aún es insuficiente. Más tarde, OpenAI publicó una prueba completa del problema de existencia y suavidad de Navier-Stokes, y el descubrimiento de Buckmaster ya había dado pasos hacia este problema. Según OpenAI, este trabajo de una semana consumió un total de
300 mil millones de tokens de salida
——Si se calcula con base en las tarifas actuales de Astra, equivale a22,5 millones de dólares estadounidenses
coste de cálculo.OpenAI fue acusado de no iniciar el sprint hasta que fue informado del progreso
"Hay otra parte de la historia que, para ser honesto, desearía mucho no tener que preocuparme", escribió Buckmaster en un comunicado. Mientras él y Alpöge estaban completando su propia investigación, dijo, se enteraron de que "la información sobre nuestro progreso había sido transmitida a OpenAI". Después de contactar a OpenAI, la otra parte dijo que había obtenido una prueba completa del problema central. Pero cuando se le preguntó cuándo comenzó OpenAI a investigar este problema y cuánta mano de obra invirtió, las respuestas de la otra parte se volvieron cada vez más vagas."Resultó que todo un equipo ya estaba trabajando en el problema, utilizando una increíble cantidad de computación... Al final, se acordó que
el primer consejo llegó a los pocos días de que la información sobre nuestro trabajo llegara a OpenAI
. "Dijo Buckmaster.Si esta afirmación es cierta, significa que el equipo de OpenAI ha creído que la dirección de investigación de Buckmaster y Alpöge es correcta y decidió utilizar sus enormes ventajas en recursos informáticos para proporcionar una prueba formal primero. El anuncio de OpenAI confirma gran parte de la línea de tiempo, señalando específicamente que el último intento comenzó el 1 de septiembre, tras los rumores de que "se habían resuelto dos acertijos del milenio". El anuncio también confirma las conversaciones en curso con Buckmaster y Alpöge.
Métodos únicos y disputas de firmas
Buckmaster dijo que si bien los matemáticos han estudiado el problema extensamente, la estrategia específica que él y sus colaboradores adoptaron estaba lejos de ser convencional, lo que lo llevó a preguntarse por qué OpenAI adoptaría el mismo enfoque al mismo tiempo.
"El camino hacia el problema de Clay a través de fuerzas suavizadoras, opciones c y d en la declaración de Fefferman, es la ruta iniciada por Luis y Diego, y la ruta que Levent y yo elegimos silenciosamente para atacar". Buckmaster escribió: "Hasta donde yo sé, casi nadie está trabajando en esta ruta. Esta no es una dirección que se pueda alcanzar entregando el planteamiento del problema al modelo y tomándose unos días".
Aunque Alpöge es empleado de Anthropic, esta investigación no se realizó en nombre de la empresa. Por lo tanto, los dos utilizaron una variedad de modelos, basándose principalmente en el Codex de OpenAI. Aun así, la relación de Alpöge con laboratorios rivales parece haberse convertido en un punto delicado para OpenAI. Buckmaster dijo que Bubeck de OpenAI le pidió que eliminara la atribución de Alpöge de una propuesta de compromiso.
Cuando Buckmaster insistió en hacer pública la controversia, Bubeck respondió: "¿Por qué arruinarías tu carrera?" Buckmaster dijo que después de que Buckmaster respondió, Bubeck dijo: "Si no quieres que sea amable, no tengo que ser amable".
Preocupaciones sobre los datos de entrenamiento y la respuesta de OpenAI
A Buckmaster también le preocupa que, debido a que utiliza ampliamente Codex al crear proyectos, la información sobre su trabajo pueda estar impulsando los propios esfuerzos de resolución de problemas de OpenAI. OpenAI se reserva el derecho de entrenar modelos de forma interactiva utilizando Codex, aunque los usuarios pueden optar por no hacerlo. Si el equipo de OpenAI utiliza un modelo basado en el entrenamiento interactivo Codex del propio Buckmaster, es posible que el modelo "repita" su trabajo cuando se enfrente a problemas similares.
OpenAI minimizó la posibilidad de recuperación de memoria en su anuncio: "Nosotros (investigadores y agentes) no vimos ninguno de sus trabajos de ninguna manera antes de su publicación pública y, en particular, no tuvimos acceso a ningún dato de usuario específico para comprender este problema". El anuncio decía: "Aunque es poco probable, no podemos descartar que el uso de datos no identificados generados por nuestro producto haya ayudado a mejorar nuestro modelo. Sin embargo, nuestras pruebas difieren significativamente, e incluso los resultados precisos en el caso Euler son diferentes (forzados versus no forzados)".
Independientemente de la controversia, es probable que el asunto reavive el debate en curso sobre el papel de la IA en la investigación matemática y las motivaciones específicas de OpenAI en ella. Buckmaster parece creer que la mejor respuesta es poner a disposición del público la mayor cantidad posible de información de investigación.
Artículos relacionados:
Se dice que el modelo de IA interno inédito de OpenAI resuelve el problema de la ecuación de Navier-Stokes
Comentarios