Juanma Aranda

INVESTIGACION

Claude no resuelve la hipótesis de Riemann, pero impulsa un resultado relacionado y valida la prueba

Anthropic probó una variante experimental de Claude con la hipótesis de Riemann. No la resolvió, pero tras generar 650 ideas y cientos de scripts en día y medio, dos subagentes mejoraron un límite de un resultado relacionado del 41,6% al 67,2%. Hubo 31 millones de tokens y validación con Lean. Prompts simples permitieron seguir iterando.

Audio con ElevenLabs

Qué ha ocurrido

Anthropic empleó una versión experimental de Claude para abordar la hipótesis de Riemann. Tras un primer intento con 650 ideas fallidas, insistieron durante alrededor de un día y medio en el que el sistema produjo cientos de scripts en Python. Dos subagentes hallaron enfoques que elevaron un límite de un resultado derivado del 41,6% al 67,2%. La IA enlazó trabajos recientes para combinar herramientas existentes, y luego intentó refutar su propio hallazgo, descargó 54 artículos en arXiv y lo rehízo desde cero. Dos matemáticos de Anthropic validaron la prueba con Lean. En total, dos sesiones de Claude Code generaron 31 millones de tokens. La empresa no espera que estas técnicas resuelvan la conjetura principal.

Qué significa para creadores

El caso ilustra un uso práctico: dejar que la IA explore muchas vías, conecte bibliografía y verifique resultados. Para proyectos creativos o técnicos, esto sugiere tres pautas: permitir iteraciones largas cuando haya margen (el experimento se sostuvo con mensajes mínimos de “sigue”); pedir búsquedas y contrastes automáticos con fuentes; y mantener validación humana antes de publicar. Conviene planificar el presupuesto computacional (el proceso produjo un gran volumen de tokens) y orientar a la IA a combinar recursos existentes más que a “inventar” de cero, donde su fuerza fue detectar conexiones útiles.

Fuente y contexto

Información de Xataka (12 de agosto de 2026) sobre un experimento de Anthropic con Claude. No resolvió la hipótesis de Riemann, pero mejoró un límite de un resultado relacionado, intentó falsarlo con literatura de arXiv y obtuvo validación vía Lean. Anthropic subraya que no prevé que estas técnicas basten para resolver la conjetura, aunque muestran utilidad al conectar trabajos previos.