Il problema si collocava all'intersezione tra teoria delle matrici e analisi funzionale nell'algebra lineare numerica, una questione di nicchia ma fondamentale, che aveva resistito a due decenni di sforzi da parte di esperti che vi avevano dedicato l'intera carriera.
Jin non stava cercando di fare storia della matematica. Stava studiando gli ultrasuoni transcranici, modellando come le onde ultrasoniche penetrano nel cranio, il che lo ha portato all'analisi delle matrici e, infine, alla congettura di Crouzeix . Tutta la sua conoscenza della matematica superiore era frutto di studio autonomo, nato dalla sua ricerca sugli ultrasuoni; la sua laurea triennale era in geologia all'Università di Pechino, e la laurea in medicina proviene dal Peking Union Medical College. Non aveva una formazione formale in matematica avanzata
.
Jin ha adattato la strategia di prompt che OpenAI aveva utilizzato per risolvere la congettura del Cycle Double Cover. Ha ideato una configurazione multi-agente e avversariale con quattro istruzioni :
Jin ha avviato il sistema e si è allontanato. Dopo circa 16 ore di funzionamento continuo, durante le quali GPT-5.6-Sol ha eseguito migliaia di cicli di generazione, verifica di ipotesi, rifiuto e ricostruzione, ha prodotto una dimostrazione completa .
Contrariamente alle stime pesanti che gli esperti si aspettavano, l'argomento utilizzava un'attenta strategia di campionamento per ridurre il problema a una semplice condizione di positività . Era, secondo chi l'ha esaminata, un approccio elegante e inaspettato.
L'analista numerico Alex Townsend della Cornell University aveva passato l'anno precedente a chiedere regolarmente a ChatGPT di attaccare la congettura di Crouzeix, vedendola arenarsi ogni volta sullo stesso lemma mancante . Il 30 luglio 2026, ha chiesto di nuovo, ma questa volta ChatGPT ha restituito un link a un preprint pubblicato il 27 luglio dal titolo "The Numerical Range Is a 2-Spectral Set"
.
Townsend e Anne Greenbaum dell'Università di Washington hanno esaminato il preprint con scetticismo. Dopo diverse ore, hanno concluso che la dimostrazione era corretta . Lo stesso Michel Crouzeix, il matematico che aveva posto la congettura 22 anni prima, ha esaminato il manoscritto e ne ha confermato la correttezza
.
Jin ha reso open source l'intera pipeline di ricerca, rendendo disponibili su GitHub il documento finale, il prompt esatto, tutte le iterazioni successive del manoscritto, una formalizzazione della dimostrazione in Lean 4 e un audit degli assiomi .
Sorprendentemente, otto giorni dopo la pubblicazione del preprint di Jin, un'altra dimostrazione indipendente, opera di Emiel Lorist e Felix Schwenninger, che avevano anch'essi utilizzato ChatGPT 5.6 per l'esplorazione di strategie, è apparsa su arXiv, corroborando in modo indipendente il risultato .
La storia della dimostrazione di Jin è notevole per diversi motivi. Dimostra che un non esperto, senza una formazione formale in un campo, può, progettando il giusto flusso di lavoro autonomo per un modello di IA all'avanguardia, dare un contributo genuino a un problema che aveva messo in crisi specialisti di carriera. Inoltre, mette in luce la potenza di sistemi di ragionamento autonomo ben progettati: Jin non ha usato l'IA come strumento di ricerca o chatbot, ma ha progettato un sistema in grado di esplorare, verificare e perfezionare il proprio lavoro per molte ore senza intervento umano .
Il problema non è un giocattolo o un rompicapo: è un problema aperto da 22 anni la cui dimostrazione è stata esaminata e accettata dal matematico che lo ha posto, insieme ad altri importanti esperti del settore .