El laboratorio de inteligencia artificial Anthropic reveló el pasado domingo que uno de sus modelos internos, aún no lanzado comercialmente, consiguió un avance relevante en la hipótesis de Riemann, uno de los desafíos matemáticos más antiguos y complejos sin resolver.
En una publicación en su sitio web oficial, la compañía detalló cómo su sistema de IA de investigación logró mejorar el conocimiento sobre la fracción de ceros de la función zeta de Riemann. El resultado no demuestra la hipótesis, pero sí representa un progreso sin precedentes.
Un problema centenario
Formulada en 1859 por el matemático alemán Bernhard Riemann, la hipótesis sostiene que existe un patrón oculto e infinitamente preciso detrás de la distribución de los números primos. Es considerada el problema no resuelto más importante de las matemáticas puras y forma parte de los siete Problemas del Milenio del Instituto Clay, con una recompensa de un millón de dólares para quien logre demostrarla.
El modelo de Anthropic no probó la hipótesis, pero sí aumentó la cota inferior conocida de ceros que la satisfacen. Pasó del 41,6% al 67,2%, un incremento de 25,6 puntos porcentuales que no tiene precedentes en la historia del problema.
36 horas de trabajo autónomo
Un integrante del equipo de Anthropic, sin formación matemática especializada, le planteó a Claude –el sistema de IA del laboratorio– la tarea de abordar uno de los problemas más famosos de las matemáticas. La inteligencia artificial trabajó de forma autónoma durante 36 horas continuas.
En ese día y medio, el modelo probó 650 ideas diferentes sin éxito antes de dar con la dirección correcta. Para ello consumió aproximadamente 31 millones de tokens y desplegó una red de 60 subagentes especializados. Según las notas al pie del informe, estos subagentes se repartieron así:
- 2 dedicados a la generación de ideas matemáticas.
- 13 para apoyo conceptual.
- 30 para explorar nuevas vías de ataque.
- 13 enfocados exclusivamente en la verificación de argumentos.
Validación interna y formalización
El hallazgo de Claude fue confirmado internamente por dos matemáticos del laboratorio de Anthropic. Además, se formalizó en Lean, un asistente de pruebas de código abierto que verifica computacionalmente la validez de los teoremas.
Este avance llega poco después de que el mismo laboratorio encontrara fallos matemáticos en algoritmos criptográficos con Claude Mythos Preview, y de que OpenAI publicara una serie de problemas resueltos por su modelo interno ‘Astra‘. El modelo de Anthropic involucrado en este hito aún no ha sido lanzado al público.
Fuente: Infobae