La hipótesis de Riemann, sin resolverse desde 1859, sigue siendo un desafío para las inteligencias artificiales más avanzadas. Recientemente, Anthropic, una empresa de tecnología, intentó abordar este problema con su modelo experimental Claude, aunque no logró resolver la hipótesis, sí consiguió un avance significativo en un problema matemático relacionado.
Jarred Sumner, un empleado de la empresa sin formación en matemáticas avanzadas, le solicitó a Claude que intentara resolver la hipótesis.

A pesar de que 650 ideas generadas por el modelo no funcionaron, la persistencia de Sumner llevó a Claude a escribir cientos de scripts en Python y realizar comprobaciones numéricas, lo que resultó en un avance en un resultado derivado de la hipótesis.
Claude logró incrementar el porcentaje de un límite conocido de 41,6% a 67,2%, explicando posteriormente cómo llegó a dicho resultado.

Este avance fue posible gracias a la capacidad de Claude de conectar trabajos recientes de diversos matemáticos que habían trabajado en la hipótesis, detectando que las herramientas desarrolladas por expertos humanos podían combinarse para superar el límite anterior.
Este tipo de investigación demuestra la utilidad de la IA para recorrer vastas colecciones de literatura y descubrir conexiones que los humanos no habían logrado. Las dos sesiones de Claude Code generaron 31 millones de tokens de salida, aunque el coste económico no se detalla.

Los agentes intentaron desmontar el resultado, buscaron contraejemplos y descargaron 54 estudios para verificar la novedad de la idea, antes de demostrarla desde cero. Dos matemáticos de Anthropic validaron la prueba resultante.
Este caso ilustra la persistencia de la IA y su potencial para contribuir a la resolución de problemas complejos, incluso si no logra resolverlos completamente.
Etiquetas: Tecnología, OpenAI, ChatGPT, Anthropic, Tecnología · OpenAI, ChatGPT y Anthropic, Tecnología · OpenAI, ChatGPT y Anthropic
