El problema se situaba en la intersección de la teoría de matrices y el análisis funcional en el álgebra lineal numérica, una cuestión nicho pero fundamental que había resistido dos décadas de esfuerzos de expertos que le habían dedicado sus carreras.
Jin no buscaba hacer historia matemática. Estaba investigando el ultrasonido transcraneal, modelando cómo las ondas de ultrasonido penetran el cráneo, lo que lo llevó al análisis matricial y, finalmente, a la conjetura de Crouzeix . Todas sus matemáticas de nivel superior fueron autodidactas a través de su investigación en ultrasonido; su licenciatura fue en geología de la Universidad de Pekín, y su título de médico provino del Peking Union Medical College. No tenía formación formal en matemáticas avanzadas
.
Jin adaptó la estrategia de prompt que OpenAI había utilizado al resolver la conjetura del Doble Recubrimiento de Ciclos (Cycle Double Cover). Diseñó una configuración multiagente y adversarial con cuatro instrucciones :
Jin puso el sistema en marcha y se fue. Después de aproximadamente 16 horas de funcionamiento continuo, durante las cuales GPT-5.6 Sol ejecutó miles de ciclos de generación, prueba de hipótesis, rechazo y reconstrucción, produjo una demostración completa .
En lugar de las estimaciones complejas que los expertos esperaban, el argumento utilizó una estrategia de muestreo cuidadoso para reducir el problema a una simple condición de positividad . Según quienes la revisaron, era un enfoque elegante e inesperado.
El analista numérico Alex Townsend de la Universidad de Cornell había pasado el año anterior preguntándole rutinariamente a ChatGPT que atacara la conjetura de Crouzeix, viéndolo estancarse en el mismo lema faltante cada vez . El 30 de julio de 2026, preguntó de nuevo, pero esta vez ChatGPT devolvió un enlace a un preprint publicado el 27 de julio titulado "The Numerical Range Is a 2-Spectral Set"
.
Townsend y Anne Greenbaum de la Universidad de Washington revisaron el preprint con escepticismo. Después de varias horas, concluyeron que la demostración era correcta . El propio Michel Crouzeix, el matemático que había planteado la conjetura 22 años antes, revisó el manuscrito y confirmó su corrección
.
Jin publicó todo su proceso de investigación en abierto, poniendo a disposición en GitHub el artículo final, el prompt exacto, todas las iteraciones sucesivas del manuscrito, una formalización de la demostración en Lean 4 y una auditoría de axiomas .
Notablemente, ocho días después de que apareciera el preprint de Jin, se publicó en arXiv una demostración independiente separada de Emiel Lorist y Felix Schwenninger, quienes también habían utilizado ChatGPT 5.6 para la exploración de estrategias, corroborando el resultado de forma independiente .
La historia de la demostración de Jin es notable por varias razones. Muestra que un no experto sin formación formal en un campo puede, al diseñar el flujo de trabajo autónomo correcto para un modelo de IA de frontera, hacer una contribución genuina a un problema que dejó perplejos a especialistas de carrera. También demuestra el poder de los sistemas de razonamiento autónomo bien diseñados: Jin no utilizó la IA como una herramienta de búsqueda o un chatbot; diseñó un sistema que podía explorar, comprobar y refinar su propio trabajo durante muchas horas sin intervención humana .
El problema no es un juguete o un rompecabezas; es un problema abierto de 22 años cuya demostración ha sido revisada y aceptada por el matemático que lo planteó, junto con otros expertos líderes en el campo .