OpenAI ने 7 अक्टूबर को गणित की तीन पांडुलिपियाँ वापस ले लीं—722 AI-निर्मित पांडुलिपियाँ GitHub पर डालने के एक दिन से भी कम समय बाद। एक लेख के अहम तर्क में चिह्न की गलती से उसका केंद्रीय प्रमाण कमजोर पड़ा। चूँकि दो अन्य लेख उसी तर्क पर निर्भर थे, वे भी उससे अपना दावा साबित नहीं कर सकते थे। यह घटना याद दिलाती है कि गणितीय लेख को सार्वजनिक कर देना और उसके दावों का स्वतंत्र सत्यापन हो जाना, एक ही बात नहीं है।
24
35
OpenAI ने क्या जारी किया था?
6 अक्टूबर को OpenAI ने अपने एक ऐसे आंतरिक मॉडल से तैयार पांडुलिपियाँ प्रकाशित कीं, जिसे सार्वजनिक रूप से जारी नहीं किया गया है। लेखों को 372 समूहों में रखा गया था। हर समूह में एक मुख्य नतीजा और उससे जुड़े तर्क, निष्कर्ष या वैकल्पिक प्रमाण हो सकते हैं। संग्रह में बीजगणित, ज्यामिति और कंप्यूटर विज्ञान सहित गणित के कई क्षेत्र शामिल हैं।
1
35
38
इस समूहबद्ध तरीके को समझना जरूरी है: 722 पांडुलिपियों का अर्थ 722 एक-दूसरे से स्वतंत्र नतीजे नहीं था। कुछ लेख दूसरे लेखों के तर्कों या रचनाओं पर निर्भर थे। वापस ली गई पांडुलिपियों के मामले में यही संबंध अहम बना।
1
24
वह चिह्न-त्रुटि जिसने तीन लेखों को प्रभावित किया
समस्या Algebraicity of Weil classes on split abelian eightfolds नाम की पांडुलिपि में सामने आई। एक महत्वपूर्ण चरण में लेख ने एक ज्यामितीय क्रिया का चिह्न +1 लिखा था, जबकि लेख में अपनाए गए नियमों के अनुसार वह −1 होना चाहिए था। इस गलती से परस्पर कटने वाले पदों पर आधारित तर्क बिगड़ गया और लेख की प्रस्तावित रचना को समर्थन नहीं मिला।
21
24
27
दो अन्य पांडुलिपियाँ इसी काम पर निर्भर थीं: Algebraicity of Kuga–Satake Correspondences for K3 Surfaces और The rational Hodge conjecture for products of K3 surfaces। आधारभूत तर्क के विफल होने के बाद, वे उससे अपने दावों को साबित नहीं कर सकती थीं। इसलिए OpenAI ने तीनों वापस लीं। इसका अर्थ यह नहीं कि जिन अनुमानों पर लेख चर्चा कर रहे थे, वे गलत साबित हो गए; विफलता उन पांडुलिपियों के तर्कों में थी।
21
24
35
GitHub सूची में क्या बदला?
7 अक्टूबर के अपडेट में तीन पांडुलिपियों की वापसी दर्ज की गई। साथ ही 14 अन्य पांडुलिपियों में संशोधन और 13 सहयोगी लेखों में संदर्भों के अपडेट बताए गए। संग्रह की संख्या 722 से घटकर 719 हुई, जबकि समूहों की संख्या 372 ही रही।
1
24
28
रिपॉज़िटरी और OpenAI की सामग्री साफ करती है कि नतीजे सत्यापन के अलग-अलग चरणों में हैं और कुछ में त्रुटियाँ हो सकती हैं। OpenAI ने बताया कि गणित और कृत्रिम बुद्धिमत्ता पर सलाहकार समूह से चर्चा ने काम साझा करने के उसके तरीके को दिशा दी। इसलिए इन पांडुलिपियों को स्थापित खोजों के बजाय जाँच और समीक्षा के लिए उपलब्ध सामग्री मानना अधिक उचित है।
1
33
39
Lean से क्या जाँचा जा सकता है—और क्या नहीं?
संग्रह के कुछ नतीजों के साथ Lean में औपचारिक प्रमाण भी दिए गए हैं। Lean एक प्रूफ असिस्टेंट है, यानी ऐसा सॉफ्टवेयर जो औपचारिक रूप में लिखे गणितीय प्रमाण की तार्किक संरचना की जाँच कर सकता है। लेकिन उपलब्ध विवरण कवरेज को अलग-अलग इकाइयों में गिनते हैं: एक सारांश 719 मुख्य नतीजों में से करीब 300 के औपचारिक रूप में होने की बात करता है, जबकि दूसरा 722 पांडुलिपियों में से 162 के मुख्य नतीजे के औपचारिक प्रमाण का उल्लेख करता है। इन आँकड़ों की गिनती का आधार अलग है; इनमें से किसी को भी यह प्रमाण नहीं समझना चाहिए कि संबंधित लेख का हर दावा स्वतंत्र रूप से जाँचा गया है।
25
33
36
सलाहकार समूह से चर्चा और औपचारिक प्रमाणों की मौजूदगी, इस संग्रह का मूल्यांकन करते समय उपयोगी संदर्भ हैं। लेकिन इनसे लिखित तर्कों और हर दावे की सीमा जाँचने की जरूरत खत्म नहीं होती। तीन पांडुलिपियों की वापसी यह भी दिखाती है कि आपस में जुड़े लेखों की समीक्षा क्यों अहम है: साझा तर्क की एक गलती एक से अधिक पांडुलिपियों को प्रभावित कर सकती है।
24
33
39
निष्कर्ष: बाकी दावों को भी जाँच के अधीन मानें
तीन पांडुलिपियों की वापसी यह स्थापित करती है कि एक खास तर्क विफल हुआ और उस पर निर्भर दो लेख अपने दावों को उसी आधार पर साबित नहीं कर सके। इससे न तो बाकी पांडुलिपियाँ गलत साबित होती हैं, न ही उनके दावे सही। हर नतीजे का मूल्यांकन अलग से करना होगा—उसके प्रमाण, मान्यताओं और संबंधित काम पर निर्भरता को ध्यान में रखकर।
1
21
35