Anthropic no espera que las técnicas de Claude demuestren la hipótesis de Riemann. La conjetura de que todos los ceros no triviales de la función zeta de Riemann están en la línea crítica, donde la parte real es un medio, sigue sin demostrarse. La afirmación más estrecha de Anthropic sigue siendo importante. Una versión de investigación no publicada de Claude produjo una prueba incondicional que eleva del 41.6% al 67.2% la cota inferior conocida para la proporción de ceros en esa línea. Es una cota sobre una proporción asintótica, no una prueba de que todos los ceros estén allí ni una afirmación sobre dónde están los demás.

La escala del salto es la noticia. El artículo de Anthropic dice que el récord del 41.6% se mantenía desde 2020. Con las cifras redondeadas del anuncio, Claude lo movió 25.6 puntos porcentuales en un solo resultado. Nada en la progresión histórica expuesta en el artículo se acerca a ese salto único. La prueba se apoya en gran medida en el trabajo de correlación por pares de Baluyot, Goldston, Suriajaya y Turnage-Butterbaugh, junto con trabajos anteriores de Bombieri. Su movimiento nuevo es una lectura desde el álgebra lineal de esa maquinaria, tratando juntos los ceros dentro y fuera de la línea mediante una forma cuadrática. El resultado amplía las matemáticas humanas; no apareció sin ellas.

La verificación es más fuerte que una transcripción de modelo que suena convincente. Anthropic publicó una formalización en Lean 4 basada en la definición de la función zeta de Mathlib y afirma que supera el comparador estándar sin marcadores de pruebas inacabadas. Los matemáticos de Anthropic Levent Alpöge y Ralph Furman estudiaron y validaron el resultado. Brian Conrey y Dan Goldston examinaron el artículo externamente con poco plazo. El trabajo del propio Conrey forma parte de la historia clásica de las cotas sobre la línea crítica, lo que da peso a su examen. Aun así, hay que nombrar el límite: Anthropic publicó el modelo, el artículo y el relato de validación. Un examen externo no es lo mismo que una publicación independiente revisada por pares.

La chispa humana fue inusualmente pequeña y concreta. Jarred Sumner, creador de Bun y no matemático, pidió a Claude que intentara seriamente la hipótesis. Anthropic dice que el modelo probó primero 650 ideas sin éxito y después pasó un día y medio coordinando unos 60 subagentes. A lo largo de 31 millones de tokens de salida, ejecutaron 2,400 comandos de shell, comprobaron argumentos candidatos y revisaron el trabajo de los demás. La intervención de Sumner consistió principalmente en mensajes de ánimo. Claude buscó después contraejemplos, descargó 54 artículos para comprobar la novedad y volvió a demostrar el hallazgo de forma independiente. Esas cifras describen una ejecución de investigación costosa, no un benchmark repetible.

Lo importante no es la anécdota motivadora ni la marca del modelo. Es un teorema concreto que mueve una cota centenaria, llega con un artefacto verificable por máquina y lleva un límite explícito de su fabricante. Como el modelo de investigación no está publicado, los investigadores externos aún no pueden probar si la capacidad se generaliza. Como la divulgación procede de una sola fuente, Anthropic, la comunidad matemática más amplia todavía debe estudiar la prueba y su novedad. Si el resultado sobrevive a ese proceso, pertenece al registro de la teoría de números. No hace que la hipótesis de Riemann esté menos sin resolver.