OpenAI dio a conocer soluciones a problemas matemáticos de larga data, obtenidas por un modelo de vanguardia aún no publicado, en 722 manuscritos que abarcan 372 familias de resultados, según informó primero The Verge. La publicación llega en medio del debate sobre ética de la investigación, conducta académica y cómo las empresas reconocen el trabajo de los matemáticos humanos en el que se basan sus sistemas y que potencialmente utilizan para producir resultados.
Las 372 familias de resultados agrupan artículos relacionados. La publicación también incluye algunos resúmenes del razonamiento del modelo, estimaciones del cómputo utilizado y estadísticas sobre la cantidad de problemas abordados. OpenAI afirma que cada resultado requirió, en promedio, el equivalente a tres horas de razonamiento de ChatGPT Pro.
En septiembre, OpenAI dijo que su modelo había resuelto más de 100 problemas abiertos de larga data en la mayoría de las áreas de las matemáticas. AGMAI afirma que la nueva publicación incluye soluciones a cientos de preguntas abiertas.
AGMAI, el Grupo Asesor sobre Matemáticas e Inteligencia Artificial, es un grupo asesor independiente de reciente creación, integrado por matemáticos de primer nivel y reunido para comunicar los resultados de forma responsable. Publicó sus primeras recomendaciones a finales de septiembre: instó a los laboratorios de IA a difundir los resultados matemáticos cuanto antes a través de los canales académicos establecidos, cuando sea posible, y a revelar el nombre del modelo, las indicaciones y los costos de cómputo.
AGMAI también instó a las empresas de IA a no utilizar la publicación de resultados matemáticos como vehículo de marketing para sus modelos, y afirmó que esa práctica causa un daño considerable a la comunidad matemática.
OpenAI dijo que publicará los resultados en un repositorio de GitHub, junto con protocolos para revisar y citar los artículos. Sigue explorando otras alternativas para esta publicación alojadas por la comunidad que cumplan con las directrices del comité. OpenAI afirmó que, de cara a futuras publicaciones, se compromete a mejorar aún más la calidad de los artículos mediante citas, exposición matemática y presentación de los resultados.
La cantidad de manuscritos da una idea de la escala de la publicación, mientras que las recomendaciones de AGMAI abordan cómo compartir los resultados.
Es probable que evaluar y asimilar el impacto total lleve tiempo. Estos resultados se suman al corpus de resultados matemáticos de OpenAI y laboratorios rivales como Anthropic, que crece rápidamente y que el campo todavía está procesando. Entre ellos hay resultados relacionados con un problema del Premio del Milenio, una de las preguntas abiertas más famosas del área.
