AHM ber matematikere avslutte samarbeidet med OpenAI. Foreningen mener at en stor publisering ikke i seg selv gjør resultatene vitenskapelig bekreftet.
Publisert avRedigert med GPT-6 LunaBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: Why has the Association for Human Mathematics (AHM) urged mathematicians to stop working with OpenAI after its October 6 release of AI-gener. Article summary: AHM urged mathematicians to stop working with OpenAI because it sees the October 6 release as a mass display of a company’s capability, not a responsible way to establish mathematical knowledge. It argues that hundreds o. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Association for Human Mathematics (AHM) ber matematikere avslutte samarbeidet med OpenAI etter at selskapet 6. oktober 2026 publiserte en stor samling matematiske manuskripter. Innvendingen handler ikke bare om at enkelte bevis kan være feil. AHM mener at en massepublisering fra en intern bedriftsmodell ikke kan erstatte grundig kontroll, dokumentasjon og faglig diskusjon.45
46
Samlingen kan inneholde interessante resultater. Men tall, bevisfiler og oppsiktsvekkende påstander er ikke i seg selv en bekreftelse. Striden handler også om hvem som får tilgang til modellen, hvem som kan undersøke hvordan resultatene ble til, og hvem som må bruke tiden på å kontrollere dem.
OpenAI oppga først at samlingen besto av 722 manuskripter innen 17 matematiske fagområder, ordnet i 372 familier av beslektede resultater. Det betyr at det ikke dreier seg om 722 separate, uavhengige oppdagelser. Det offentlige GitHub-arkivet inneholder manuskripter og tilhørende bevismateriale, og er publisert under Apache-2.0-lisensen.7
15
Selskapet opplyste at modellen ble prøvd på omtrent 4 000 problemer. I gjennomsnitt tilsvarte beregningsbruken per resultat rundt tre timer med ChatGPT Pro Thinking. OpenAI publiserte også ti forkortede sammendrag av modellens resonnement og Lean-formaliseringer for noen av bevisene.7
12
16 Arkivet understreker at resultatene er på ulike stadier av kontroll, og at ikke alle har Lean-formalisering. Den nåværende katalogen viser 719 manuskripter, mot de 722 som ble oppgitt ved lanseringen.
10
11
Blant påstandene i samlingen er resultater knyttet til Mahler-formodningene og den eksakte irrasjonalitetseksponenten til π. Slike påstander bør ikke regnes som endelig bekreftet bare fordi de er publisert som manuskripter.5
21
I sin uttalelse skrev AHM at matematikerne «ikke ba om at dette arbeidet skulle gjøres», og beskrev publiseringen av hundrevis av filer som en «demonstrasjon av makt», ikke som vitenskapelig arbeid. Foreningen ber om skepsis og forskning med mennesker i sentrum, framfor rask aksept eller massebehandling av resultater fra et selskap.45
46
En praktisk utfordring er omfanget. Fagfolk må lese manuskriptene, kontrollere bevisene og sette resultatene inn i sammenheng med tidligere forskning. Å legge ut filene åpent gir forskere materiale å undersøke, men gjør ikke denne jobben for dem. I stor grad flyttes arbeidet med gjennomgangen over på forskningsmiljøene.
AHM knyttet også kritikken til en advarsel fra Advisory Group on Mathematics and Artificial Intelligence, en gruppe som skal gi AI-selskaper råd om forholdet deres til matematisk forskning. Ifølge AHM hadde gruppen advart mot at selskaper tester avanserte matematikkproblemer på interne modeller.45
48
Lean-formaliseringer er et viktig kontrollverktøy: De gjør det mulig å la en datamaskin sjekke bevis som faktisk er oversatt til systemet. OpenAI opplyser at hovedresultatet i 162 manuskripter er formalisert.5 Det styrker kontrollen av akkurat disse resultatene, men bekrefter ikke automatisk alle påstandene i alle manuskriptene.
Når en slik formalisering mangler, må argumentet vurderes ved at noen leser og kontrollerer det. Arkivet sier selv at resultatene er på ulike stadier av verifisering, og at ikke alle har Lean-formaliseringer.10
11 Det mest rimelige er derfor å vurdere hvert resultat for seg – ikke å behandle hele samlingen som enten bevist eller verdiløs.
Opplysningene om problemene modellen ble prøvd på, beregningsbruken og de ti resonnementssammendragene gir et visst innblikk i hvordan arbeidet ble til.7
12
16 Men de viser ikke hele historikken bak hvert resultat. Modellen er fortsatt intern og ikke tilgjengelig for uavhengig undersøkelse.
7
11
Tallet på prøvde problemer forteller heller ikke alene hvor ofte modellen lyktes på et klart avgrenset utvalg av særlig vanskelige, åpne problemer. For å vurdere både ytelse og om resultatene kan gjenskapes, trenger forskere mer informasjon om metoden og hvordan de enkelte resultatene ble produsert.
OpenAI har sagt at selskapet planlegger verksteder og konferanser der viktige resultater kan undersøkes.7 Slike tiltak kan gjøre faglig kontroll enklere, men erstatter ikke nok offentlig dokumentasjon til at andre forskere selv kan vurdere hvordan bevisene ble til.
Det finnes ikke noe enkelt svar på hva samlingen er verdt. AI-genererte argumenter kan romme reell matematisk framgang, men verdien av dem avhenger av hvilke resultater som tåler uavhengig kontroll – ikke av hvor mange manuskripter som publiseres, eller hvor betydningsfulle problemene beskrives som.7
10
AHMs reaksjon løfter også spørsmål om anerkjennelse av tidligere menneskelig arbeid, tiden det tar å vurdere nye resultater og faren for at prioriteringer eller støtte til menneskelig forskning kan endre seg. Publiseringen gir ikke svar på disse spørsmålene, men gjør dem mer presserende.45
46
Kjernen i saken er å skille mellom evnen til å produsere mange matematiske påstander og vitenskapelig bekreftelse av dem. Striden handler om begge deler: hva AI kan bidra med i matematikken, og hvilke spilleregler som må til for at bidragene skal være etterprøvbare, åpne og nyttige for forskningsmiljøet.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
AHM ber matematikere avslutte samarbeidet med OpenAI. Foreningen mener at en stor publisering ikke i seg selv gjør resultatene vitenskapelig bekreftet.
AHM ber matematikere avslutte samarbeidet med OpenAI. Foreningen mener at en stor publisering ikke i seg selv gjør resultatene vitenskapelig bekreftet. OpenAI la fram manuskripter, bevismateriale og Lean formaliseringer for noen resultater – men ikke for hele samlingen.
Striden handler både om mulig matematisk framgang og om åpenhet, arbeidsbyrden ved etterprøving og menneskers rolle i forskningen.
AHM ber matematikere avslutte samarbeidet med OpenAI. Foreningen mener at en stor publisering ikke i seg selv gjør resultatene vitenskapelig bekreftet.
Publisert avRedigert med GPT-6 LunaBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: Why has the Association for Human Mathematics (AHM) urged mathematicians to stop working with OpenAI after its October 6 release of AI-gener. Article summary: AHM urged mathematicians to stop working with OpenAI because it sees the October 6 release as a mass display of a company’s capability, not a responsible way to establish mathematical knowledge. It argues that hundreds o. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Association for Human Mathematics (AHM) ber matematikere avslutte samarbeidet med OpenAI etter at selskapet 6. oktober 2026 publiserte en stor samling matematiske manuskripter. Innvendingen handler ikke bare om at enkelte bevis kan være feil. AHM mener at en massepublisering fra en intern bedriftsmodell ikke kan erstatte grundig kontroll, dokumentasjon og faglig diskusjon.45
46
Samlingen kan inneholde interessante resultater. Men tall, bevisfiler og oppsiktsvekkende påstander er ikke i seg selv en bekreftelse. Striden handler også om hvem som får tilgang til modellen, hvem som kan undersøke hvordan resultatene ble til, og hvem som må bruke tiden på å kontrollere dem.
OpenAI oppga først at samlingen besto av 722 manuskripter innen 17 matematiske fagområder, ordnet i 372 familier av beslektede resultater. Det betyr at det ikke dreier seg om 722 separate, uavhengige oppdagelser. Det offentlige GitHub-arkivet inneholder manuskripter og tilhørende bevismateriale, og er publisert under Apache-2.0-lisensen.7
15
Selskapet opplyste at modellen ble prøvd på omtrent 4 000 problemer. I gjennomsnitt tilsvarte beregningsbruken per resultat rundt tre timer med ChatGPT Pro Thinking. OpenAI publiserte også ti forkortede sammendrag av modellens resonnement og Lean-formaliseringer for noen av bevisene.7
12
16 Arkivet understreker at resultatene er på ulike stadier av kontroll, og at ikke alle har Lean-formalisering. Den nåværende katalogen viser 719 manuskripter, mot de 722 som ble oppgitt ved lanseringen.
10
11
Blant påstandene i samlingen er resultater knyttet til Mahler-formodningene og den eksakte irrasjonalitetseksponenten til π. Slike påstander bør ikke regnes som endelig bekreftet bare fordi de er publisert som manuskripter.5
21
I sin uttalelse skrev AHM at matematikerne «ikke ba om at dette arbeidet skulle gjøres», og beskrev publiseringen av hundrevis av filer som en «demonstrasjon av makt», ikke som vitenskapelig arbeid. Foreningen ber om skepsis og forskning med mennesker i sentrum, framfor rask aksept eller massebehandling av resultater fra et selskap.45
46
En praktisk utfordring er omfanget. Fagfolk må lese manuskriptene, kontrollere bevisene og sette resultatene inn i sammenheng med tidligere forskning. Å legge ut filene åpent gir forskere materiale å undersøke, men gjør ikke denne jobben for dem. I stor grad flyttes arbeidet med gjennomgangen over på forskningsmiljøene.
AHM knyttet også kritikken til en advarsel fra Advisory Group on Mathematics and Artificial Intelligence, en gruppe som skal gi AI-selskaper råd om forholdet deres til matematisk forskning. Ifølge AHM hadde gruppen advart mot at selskaper tester avanserte matematikkproblemer på interne modeller.45
48
Lean-formaliseringer er et viktig kontrollverktøy: De gjør det mulig å la en datamaskin sjekke bevis som faktisk er oversatt til systemet. OpenAI opplyser at hovedresultatet i 162 manuskripter er formalisert.5 Det styrker kontrollen av akkurat disse resultatene, men bekrefter ikke automatisk alle påstandene i alle manuskriptene.
Når en slik formalisering mangler, må argumentet vurderes ved at noen leser og kontrollerer det. Arkivet sier selv at resultatene er på ulike stadier av verifisering, og at ikke alle har Lean-formaliseringer.10
11 Det mest rimelige er derfor å vurdere hvert resultat for seg – ikke å behandle hele samlingen som enten bevist eller verdiløs.
Opplysningene om problemene modellen ble prøvd på, beregningsbruken og de ti resonnementssammendragene gir et visst innblikk i hvordan arbeidet ble til.7
12
16 Men de viser ikke hele historikken bak hvert resultat. Modellen er fortsatt intern og ikke tilgjengelig for uavhengig undersøkelse.
7
11
Tallet på prøvde problemer forteller heller ikke alene hvor ofte modellen lyktes på et klart avgrenset utvalg av særlig vanskelige, åpne problemer. For å vurdere både ytelse og om resultatene kan gjenskapes, trenger forskere mer informasjon om metoden og hvordan de enkelte resultatene ble produsert.
OpenAI har sagt at selskapet planlegger verksteder og konferanser der viktige resultater kan undersøkes.7 Slike tiltak kan gjøre faglig kontroll enklere, men erstatter ikke nok offentlig dokumentasjon til at andre forskere selv kan vurdere hvordan bevisene ble til.
Det finnes ikke noe enkelt svar på hva samlingen er verdt. AI-genererte argumenter kan romme reell matematisk framgang, men verdien av dem avhenger av hvilke resultater som tåler uavhengig kontroll – ikke av hvor mange manuskripter som publiseres, eller hvor betydningsfulle problemene beskrives som.7
10
AHMs reaksjon løfter også spørsmål om anerkjennelse av tidligere menneskelig arbeid, tiden det tar å vurdere nye resultater og faren for at prioriteringer eller støtte til menneskelig forskning kan endre seg. Publiseringen gir ikke svar på disse spørsmålene, men gjør dem mer presserende.45
46
Kjernen i saken er å skille mellom evnen til å produsere mange matematiske påstander og vitenskapelig bekreftelse av dem. Striden handler om begge deler: hva AI kan bidra med i matematikken, og hvilke spilleregler som må til for at bidragene skal være etterprøvbare, åpne og nyttige for forskningsmiljøet.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
AHM ber matematikere avslutte samarbeidet med OpenAI. Foreningen mener at en stor publisering ikke i seg selv gjør resultatene vitenskapelig bekreftet.
AHM ber matematikere avslutte samarbeidet med OpenAI. Foreningen mener at en stor publisering ikke i seg selv gjør resultatene vitenskapelig bekreftet. OpenAI la fram manuskripter, bevismateriale og Lean formaliseringer for noen resultater – men ikke for hele samlingen.
Striden handler både om mulig matematisk framgang og om åpenhet, arbeidsbyrden ved etterprøving og menneskers rolle i forskningen.