Anthropic meldt dat Claude in 11 dagen een complete Lean formalisering maakte van het al bekende bewijs van Fermats laatste stelling: ongeveer 13 miljoen regels code en 29.500 tussenstellingen in de uiteindelijke afha... Via Prove2Me werd het werk volgens Anthropic opgesplitst in een afhankelijkheidsgraaf, zodat age...
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Anthropic’s Claude reportedly produce the first end-to-end Lean computer-verified proof of Fermat’s Last Theorem in 11 days—includin. Article summary: Anthropic says Claude did not discover a new proof of Fermat’s Last Theorem (FLT); it translated a known modern route into a complete Lean artifact that Lean’s kernel can check. The reported advance is the scale and rela. Topic tags: general, education, general web, user generated, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Anthropic zegt dat Claude de eerste volledige, van begin tot eind computergecontroleerde Lean-formalisering van Fermats laatste stelling heeft geproduceerd. De cruciale nuance: Claude heeft het bewijs van de stelling niet ontdekt. Het systeem zou een al bekende moderne bewijsroute hebben omgezet in een zeer groot formeel artefact dat Lean mechanisch kan verifiëren. Volgens Anthropic kostte dat ongeveer elf dagen grotendeels autonoom agentwerk en leverde het circa 13 miljoen regels Lean-code op. 21
5
Fermats laatste stelling zegt dat de vergelijking (a^n+b^n=c^n), voor natuurlijke getallen en een exponent van minstens 3, geen niet-triviale oplossing heeft. In de Lean-formulering van Mathlib geldt: bij elke oplossing moet (a=0), (b=0) of (c=0) zijn. Dat is equivalent aan de bekende uitspraak over positieve gehele getallen. 31
Het project volgde de Darmon–Diamond–Taylor-presentatie van de Wiles/Taylor–Wiles-strategie, in plaats van een nieuwe route door de wiskunde te vinden. Dat onderscheid is belangrijk. Een formalisering moet niet alleen de hoofdgedachte vastleggen, maar ook definities, voorwaarden, hulpresultaten en alle verbindende stappen die een gewoon wiskundig artikel vaak impliciet laat. Eerder werk rond het FLT-project van Imperial College London omschrijft die route eveneens als een moderne variant van het Wiles/Taylor–Wiles-bewijs. 5
11
Een formele bewijsassistent accepteert niet: „dit volgt uit een standaardargument”. Elke gevolgtrekking moet worden uitgedrukt op een manier die het systeem kan type-checken, en elk resultaat moet steunen op al geformaliseerde afhankelijkheden.
Anthropic meldt dat tijdens het project ongeveer 30.300 computergeverifieerde stellingen zijn geproduceerd; circa 29.500 daarvan komen voor in de uiteindelijke afhankelijkheidsketen. De ontwikkeling bestrijkt onder meer algebra, meetkunde, harmonische analyse en getaltheorie. 21
5
Die schaal verklaart waarom „11 dagen” niet moet worden gelezen als een vervanging van de lange intellectuele geschiedenis achter Fermats laatste stelling. Anthropic spreekt ook over ruwweg zes miljard gegenereerde tokens. Daarin zaten vele kandidaatbewijzen, Lean-controles, foutgestuurde reparaties en het technische werk om een langlopend formalisatieproject te organiseren. 5
De gemelde prestatie berustte op meer dan één taalmodel dat een immens bewijs in zijn context probeert vast te houden. Anthropic zegt dat eerdere pogingen vooruitgang boekten, maar moeite hadden om de gedeelde projecttoestand te bewaren. De succesvolle uitvoering gebruikte een op Prove2Me gebaseerde werkomgeving, een platform voor gezamenlijke wiskundige formalisering. 5
29
De kern is een gerichte afhankelijkheidsgraaf:
Prove2Me beschrijft dit als het starten van formalisatie-„missies” waaraan agenten herbruikbare formele bewijzen bijdragen. 29 In de praktijk maakt zo’n graaf van één lange, kwetsbare opdracht een verzameling controleerbare deeltaken. Tegelijk ontstaat projectgeheugen buiten de afzonderlijke uitvoering van een model.
Volgens Anthropic bevat het eindproject geen sorry-placeholders — Leans mechanisme om een bewering toe te laten zonder bewijs — en steunt het alleen op Leans drie standaardaxioma’s. 5
Dat gaat verder dan een AI die een overtuigend ogend bewijs in gewone taal schrijft. De kernel van Lean controleert of elke gecodeerde stap volgt uit de logische regels, axioma’s en geïmporteerde afhankelijkheden van het systeem. Anthropic zegt bovendien te hebben gecontroleerd dat de eindclaim overeenkomt met de gevestigde FermatLastTheorem-formulering in Mathlib. 5
31
Die kernelcontrole heeft echter een duidelijke grens: zij verifieert de formele stelling die is gecodeerd. Mensen moeten nog steeds beoordelen of de formele definities en tussenstellingen de bedoelde informele wiskunde getrouw weergeven. Onafhankelijke compilatie van het vrijgegeven artefact en deskundige controle van de afhankelijkheidsketen blijven daarom essentiële toetsen van de gemelde prestatie.
Kevin Buzzard noemde het resultaat volgens het verslag van Anthropic een „buitengewone prestatie in autoformalisering”. 21 De betekenis zit niet alleen in het afmaken van losse Lean-oefeningen door agenten. De claim is dat zij een diep gelaagde, herbruikbare formele ontwikkeling hebben samengesteld op een schaal waarvoor eerder jaren van gecoördineerd menselijk werk werden verwacht.
Als dit soort werk reproduceerbaar en betaalbaar wordt, kan formalisering de wiskunde op meerdere manieren helpen:
Dit zijn mogelijke voordelen, geen automatische vervanging van wiskundig oordeel. Een formeel bewijs kan logisch geldig zijn en toch de verkeerde stelling formaliseren. Ook blijven de kosten van een artefact van 13 miljoen regels aanzienlijk.
De gemelde FLT-formalisering is een betekenisvolle maatstaf voor AI-ondersteunde formalisering, juist omdat de doelstelling al bekend was en het eindartefact onafhankelijk controleerbaar hoort te zijn. Het moet niet worden voorgesteld als een nieuwe oplossing van Fermats laatste stelling door Claude.
De sterkste, maar beperktere conclusie is: Anthropic meldt dat een gecoördineerd agentsysteem een belangrijk bestaand bewijs heeft vertaald naar een Lean-ontwikkeling op ongekende schaal, met grafgebaseerde taakopsplitsing en formele verificatie als feedbacklus. 21
5
29
De volgende vragen zijn praktisch: kunnen externe onderzoekers de build reproduceren, de bedoelde betekenis van de formalisering toetsen, onderdelen hergebruiken en vergelijkbare resultaten behalen in andere geavanceerde delen van de wiskunde? Die tests zullen uitwijzen of dit een eenmalige technische demonstratie is of een duurzame verandering in de manier waarop moderne bewijzen worden gebouwd en gecontroleerd.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Anthropic meldt dat Claude in 11 dagen een complete Lean formalisering maakte van het al bekende bewijs van Fermats laatste stelling: ongeveer 13 miljoen regels code en 29.500 tussenstellingen in de uiteindelijke afha...
Anthropic meldt dat Claude in 11 dagen een complete Lean formalisering maakte van het al bekende bewijs van Fermats laatste stelling: ongeveer 13 miljoen regels code en 29.500 tussenstellingen in de uiteindelijke afha... Via Prove2Me werd het werk volgens Anthropic opgesplitst in een afhankelijkheidsgraaf, zodat agenten definities en lemma’s als herbruikbare deeltaken konden formaliseren terwijl Lean de resultaten controleerde.
Een Lean controle toont dat de gecodeerde stelling uit de opgegeven axioma’s en imports volgt.