베이징 협화병원 신경외과 전공의 진산무 박사가 GPT 5.6 Sol 모델을 16시간 자율 실행해 크루제 추측을 증명했다. 그는 정식 고급 수학 교육을 받지 않았다. 증명 결과는 알렉스 타운센드, 앤 그린바움 등 수치해석 전문가와 문제를 제기한 미셸 크루제本人의 검증을 통과했다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: How did Chinese neurosurgeon Jin Shanmu use OpenAI's GPT-5.6-Sol on ChatGPT Work to solve the two-decade-old Crouzeix's conjecture — a probl. Article summary: Let me search for this specificLet me gather a few more details from the best source. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026년 7월 말, 22년 동안 풀리지 않던 수치 선형대수학의 난제가 해결됐다. 정상급 대학의 종신 교수가 아닌, 베이징의 한 신경외과 전공의가 프롬프트를 설정하고 컴퓨터를 떠난 지 16시간 만에 GPT-5.6-Sol이 스스로 증명을 찾아낸 것이다.
베이징 협화병원의 박사후 연구원이자 신경외과 전공의인 진산무 박사는 OpenAI의 GPT-5.6-Sol 모델을 ChatGPT Work 플랫폼에서 사용해 크루제 추측(Crouzeix's conjecture)의 완전한 증명을 자율적으로 생성해냈다 . 이 문제는 프랑스 수학자 미셸 크루제가 2004년 제기한 이후 20년 넘게 세계 최고의 수치해석학자들을 고전시켜 왔다.
크루제 추측은 임의의 정사각 복소 행렬 A와 다항식 p에 대해 연산자 노름 ||p(A)||이 A의 수치 범위에 대한 |p|의 최댓값의 2배를 넘지 않는다는 내용이다. 이전 최고 기록은 1+√2(약 2.414)로, 2017년 미국 수학연구소 워크숍에서 최고 전문가들이 모여도 2라는 정확한 상수까지의 간극을 메우지 못한 상태였다 .
진 박사는 수학적 역사를 만들려 한 게 아니었다. 그는 경두개 초음파(초음파가 두개골을 어떻게 투과하는지 모델링하는 연구)를 진행하다가 행렬 분석에 빠져들었고, 결국 크루제 추측에 이르게 됐다 . 그의 고급 수학 지식은 모두 초음파 연구를 통한 독학이었다. 학부는 베이징대학교 지질학과였고, 의학 학위는 베이징 협화의과대학에서 받았다. 정식 고급 수학 교육은 전혀 받지 않았다
.
진 박사는 OpenAI가 사이클 이중 덮개 추측을 해결할 때 사용했던 프롬프트 전략을 차용했다. 그는 다음과 같은 4가지 지침을 바탕으로 다중 에이전트 대립형 시스템을 설계했다 :
진 박사는 시스템을 가동하고 자리를 떴다. 약 16시간 동안 GPT-5.6-Sol은 수천 번의 생성, 가설 검증, 기각, 재구축 사이클을 반복한 끝에 완전한 증명을 만들어냈다 .
전문가들이 예상했던 무거운 추정 대신, 이 증명은 세심한 샘플링 전략을 사용해 문제를 단순한 양의 조건으로 축소했다 . 검토자들에 따르면, 이는 우아하고 예상치 못한 접근법이었다.
코넬대학교의 수치해석학자 알렉스 타운센드는 지난 1년간 정기적으로 ChatGPT에게 크루제 추측을 공격하게 했지만 매번 같은 보조정리에서 막히는 모습을 지켜봤다 . 2026년 7월 30일, 그는 다시 질문했지만 이번에 ChatGPT는 7월 27일에 게시된 "수치 범위는 2-스펙트럼 집합이다"라는 제목의 프리프린트 링크를 반환했다
.
타운센드와 워싱턴대학교의 앤 그린바움이 회의적으로 검토를 시작했지만 몇 시간 후 증명이 정확하다는 결론을 내렸다 . 22년 전 이 추측을 제기했던 미셸 크루제本人도 원고를 검토하고 정확성을 확인했다
.
진 박사는 전체 연구 파이프라인을 오픈소스로 공개했다. GitHub에는 최종 논문, 정확한 프롬프트, 모든 연속적 원고 버전, Lean 4 형식 증명, 공리 감사 보고서가 포함됐다 .
놀랍게도 진 박사의 프리프린트가 공개된 지 8일 후, Emiel Lorist와 Felix Schwenninger가 ChatGPT 5.6을 전략 탐색에 사용해 도출한 별도의 독립 증명이 arXiv에 게시되며 결과를 별도로 확인해줬다 .
진 박사의 증명 이야기는 여러 측면에서 주목할 만하다. 해당 분야의 정식 교육을 받지 않은 비전문가가 첨단 AI 모델에 적절한 자율 워크플로를 설계함으로써 평생을 바친 전문가들을 곤란하게 만들었던 문제에 진정한 기여를 할 수 있음을 보여준다. 또한 잘 설계된 자율 추론 시스템의 힘을 입증한다. 진 박사는 AI를 검색 도구나 챗봇으로 사용한 것이 아니라, 인간의 개입 없이 수시간 동안 스스로 탐색하고 점검하며 개선할 수 있는 시스템을 설계한 것이다 .
이 문제는 장난감이나 퍼즐이 아니다. 문제를 제기한 수학자本人과 해당 분야 최고 권위자들이 검증하고 인정한, 22년 묵은 미해결 난제의 증명이다 .
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
베이징 협화병원 신경외과 전공의 진산무 박사가 GPT 5.6 Sol 모델을 16시간 자율 실행해 크루제 추측을 증명했다. 그는 정식 고급 수학 교육을 받지 않았다.
베이징 협화병원 신경외과 전공의 진산무 박사가 GPT 5.6 Sol 모델을 16시간 자율 실행해 크루제 추측을 증명했다. 그는 정식 고급 수학 교육을 받지 않았다. 증명 결과는 알렉스 타운센드, 앤 그린바움 등 수치해석 전문가와 문제를 제기한 미셸 크루제本人의 검증을 통과했다.
진 박사는 프롬프트, 증명 원고, Lean 4 형식 증명, 공리 감사 보고서를 모두 오픈소스로 공개했다.