فهرست مطالب
OpenAI شامگاه سهشنبه ۱۴ مهر ۱۴۰۵ به وقت آمریکا (بامداد چهارشنبه به وقت ایران) ۷۲۲ مقالهٔ ریاضی را یکجا در گیتهاب منتشر کرد. به گفتهٔ این شرکت، همهٔ این مقالهها را یک مدل هوش مصنوعی داخلی و هنوز منتشرنشده نوشته و در آنها صدها مسئلهٔ باز ریاضی و علوم کامپیوتر نظری یا حل شدهاند یا قدم مهمی به جلو برداشتهاند. مقالهها در ۳۷۲ گروه نتیجه دستهبندی شدهاند و برای بخش زیادی از آنها اثبات کامپیوتری هم گذاشته شده است.
این خبر فقط یک رکورد تازه نیست؛ دنیای ریاضی را دو دسته کرده است. بعضی ریاضیدانها میگویند بالاخره همهچیز روی میز آمده و میشود آن را بررسی کرد. گروهی دیگر میگویند OpenAI حجم عظیمی کار بررسینشده را روی دوش جامعهٔ ریاضی گذاشته، بدون آنکه مدل یا دستورهای اصلی را نشان بدهد. در این مطلب به زبان ساده توضیح میدهیم دقیقاً چه چیزی منتشر شد، کدام ادعاها مهمترند، «اثبات کامپیوتری» یعنی چه و چرا هنوز نباید همهٔ این نتیجهها را قطعی دانست.
پاسخ کوتاه: OpenAI دقیقاً چه کرد؟
۷۲۲ مقاله در ۳۷۲ خانواده: هر «خانواده» یک نتیجهٔ اصلی است، بههمراه مقالههای همراه، پیامدها یا اثباتهای دیگرِ همان نتیجه.
از دل حدود ۴٬۰۰۰ مسئله: OpenAI میگوید در طول این ارزیابی حدود چهار هزار مسئله به مدل داده شد و آنچه منتشر شده، بخش «بهقدر کافی مهم» خروجیهاست.
هر نتیجه بهطور میانگین سه ساعت فکر: یعنی معادل حدود سه ساعت «فکر کردن» در ChatGPT Pro، اما با همان مدل داخلی که هنوز در دسترس عموم نیست.
اثبات کامپیوتری برای خیلیها، نه همه: بسیاری از اثباتها به زبان Lean هم نوشته شدهاند تا کامپیوتر بتواند منطقشان را چک کند. خود OpenAI نوشته بعضی نتیجههای بدون این پشتوانه «ممکن است ایراد داشته باشند».
بحث داغ دربارهٔ شفافیت: مدل، دستورهای دقیق (پرامپتها) و هزینهٔ هر نتیجه منتشر نشده؛ همان چیزهایی که یک گروه مشورتی مستقل ریاضیدانها هفتهٔ پیش خواسته بود.
برای تازهواردها: چند مفهوم پایه
«مسئلهٔ باز» در ریاضی یعنی چه؟
مسئلهٔ باز سؤالی است که ریاضیدانها مدتها رویش کار کردهاند و هنوز کسی جواب قطعی و پذیرفتهشدهای برایش پیدا نکرده است. بعضی از این سؤالها چند سال عمر دارند و بعضی چند دهه. حل یک مسئلهٔ باز مهم، معمولاً نتیجهٔ سالها کار یک پژوهشگر یا یک گروه است و میتواند مسیر یک شاخهٔ کامل از ریاضی را عوض کند.
اثبات چطور «پذیرفته» میشود؟
در ریاضی، گفتن «من حلش کردم» کافی نیست. اثبات باید نوشته شود، متخصصان دیگر آن را خطبهخط بخوانند، ایرادهایش پیدا و رفع شود و معمولاً در یک مجلهٔ علمی با داوری منتشر شود. برای مسئلههای خیلی بزرگ این روند ممکن است سالها طول بکشد. برای همین وقتی ۷۲۲ مقاله یکشبه منتشر میشود، بررسی دقیق همهشان کار ماهها و شاید سالهاست.
Lean چیست و چرا اینقدر مهم شده؟
Lean یک زبان برنامهنویسی ویژه است که در آن میشود اثبات ریاضی را قدمبهقدم نوشت تا نرمافزار، درستی هر قدم منطقی را خودکار بررسی کند. اگر اثباتی در Lean قبول شود، تقریباً مطمئنیم که منطقش درست است. اما یک نکتهٔ ظریف هم هست: انسان باید چک کند که «جملهٔ» نوشتهشده در Lean واقعاً همان مسئلهای است که ریاضیدانها دنبالش بودند. اگر صورت مسئله اشتباه یا ضعیفتر نوشته شده باشد، کامپیوتر چیز دیگری را تأیید کرده است.
چه چیزی در گیتهاب منتشر شد؟
همهچیز در مخزنی به نام openai/math در گیتهاب قرار گرفته است. گیتهاب سایتی است که برنامهنویسها و پژوهشگرها فایلها و کدهایشان را آنجا نگه میدارند و نسخههای مختلفش را ثبت میکنند. طبق توضیحات خود مخزن، این مجموعه شامل این بخشهاست:
فایل PDF و متن اصلی مقالهها بههمراه دستور ارجاع (citation) برای هر مقاله
یک فهرست کلی که هر خانواده را توضیح میدهد و آن را در یک شاخهٔ ریاضی قرار میدهد
کتابخانهٔ Lean برای اثباتهایی که به زبان کامپیوتری نوشته شدهاند
۱۰ خلاصهٔ کوتاهشده از «زنجیرهٔ فکر» مدل؛ یعنی گزارشی از اینکه مدل در چند مسئلهٔ انتخابی چطور جلو رفته است
قاعدهٔ نسخهبندی: اگر مقالهای اصلاح شود، نسخهٔ جدید ثبت میشود و نسخههای قبلی هم در دسترس میمانند
این نتیجهها از چه شاخههایی هستند؟
دامنهٔ کار بسیار گسترده است: نظریهٔ اعداد، هندسه، جبر، احتمال، فیزیک ریاضی، معادلات دیفرانسیل و علوم کامپیوتر نظری. سایت Kingy که فهرست کامل را شمرده، میگوید خانوادهها در ۱۷ شاخه پخش شدهاند و بیشترینشان (۴۰ خانواده) به علوم کامپیوتر نظری مربوط است. OpenAI هم در وبلاگش گفته قصد دارد برای فهم بهتر این نتیجهها کارگاه، کنفرانس و برنامههای ویژهای را تأمین مالی کند.
همهٔ مقالهها را خود مدل نوشته؟
به گفتهٔ OpenAI «اکثریت بسیار بزرگ» نتیجهها با یک روش ثابت و با همان مدل داخلی به دست آمدهاند. دو استثنا را خود شرکت اعلام کرده: کار روی یک ناحیه بدون صفر برای تابع زتای ریمان، و اثبات حدس هاج برای دستهای خاص از اشکال هندسی. همچنین متن یکی از مقالههای مربوط به تابع زتا را یک انسان برای خوانایی ویرایش کرده است. نشریهٔ Scientific American هم از قول سخنگوی OpenAI نوشته که تقریباً همهٔ نتیجهها در پاسخ به یک پرامپت و با یک عامل هوش مصنوعی تولید شدهاند؛ ادعایی که فعلاً کسی بیرون از شرکت نمیتواند آن را تکرار و آزمایش کند.
مهمترین ادعاها کداماند؟
در میان صدها عنوان، چند ادعا بیشترین توجه را گرفتهاند. پیش از خواندنشان یک نکته را در نظر داشته باشید: اینها ادعا هستند. هیچکدام هنوز توسط ریاضیدانهای مستقل تأیید کامل نشدهاند.
«شبهفرضیهٔ ریمان»؛ نه خود فرضیهٔ ریمان
فرضیهٔ ریمان شاید مشهورترین مسئلهٔ حلنشدهٔ ریاضی باشد و به نحوهٔ پخش شدن عددهای اول ربط دارد. خلاصهاش این است که همهٔ «صفرهای مهم» یک تابع خاص به نام زتای ریمان روی یک خط مشخص قرار دارند. مقالهٔ OpenAI این را ثابت نمیکند. ادعای آن ضعیفتر اما همچنان مهم است: اینکه در بخشی از صفحه (جایی که بخش حقیقی عدد بیشتر از ۷/۸ است) اصلاً هیچ صفری وجود ندارد. یک مقالهٔ همراه هم همین را با مرز ۱۱/۱۲ و از راه دیگری ثابت کرده است. والاستریت ژورنال نوشته الکس کانتوروویچ، استاد ریاضی دانشگاه راتگرز، در X دربارهٔ این نتیجه گفته اگر یک انسان چنین کاری کرده بود، «بیبرو برگرد مدال فیلدز» میگرفت.
حدس «بازیهای یکتا» در علوم کامپیوتر
خیلی از مسئلههای عملی را نمیشود بهطور کامل و سریع حل کرد؛ برای همین دنبال الگوریتمهایی میگردیم که جوابی «نزدیک به بهترین» بدهند. حدس بازیهای یکتا (Unique Games Conjecture) که سوبهاش کوت در سال ۲۰۰۲ مطرح کرد، میگوید برای بسیاری از این مسئلهها، الگوریتمهای فعلی تقریباً بهترین چیزی هستند که میشود داشت؛ مگر اینکه یکی از بزرگترین فرضهای علوم کامپیوتر غلط از آب دربیاید. OpenAI ادعا میکند این حدس را ثابت کرده و یکی از ۱۰ خلاصهٔ استدلال هم به همین موضوع مربوط است.
حدس هاج برای یک دستهٔ خاص از اشکال
حدس هاج یکی از هفت مسئلهٔ جایزهٔ هزارهٔ مؤسسهٔ ریاضی کلی (Clay) است و دربارهٔ رابطهٔ «سوراخها» و ساختار اشکالی است که با معادلههای چندجملهای ساخته میشوند. ادعای OpenAI فقط برای یک خانوادهٔ خاص و بسیار متقارن از این اشکال است (به اسم «واریتههای آبلی CM»)، نه کل حدس. به گزارش OfficeChai، این نتیجه هنوز اثبات Lean ندارد و باید با خواندن دقیق متخصصان بررسی شود.
چند نتیجهٔ دیگر که اسمشان زیاد شنیده میشود
عدد پی: ادعا شده «توان گنگی» عدد π دقیقاً ۲ است؛ یعنی π را نمیشود با کسرهای ساده بیش از حد معمول خوب تقریب زد.
ثابت کاتالان: ادعا شده این عدد مشهور گنگ است؛ یعنی نمیشود آن را بهصورت کسر دو عدد صحیح نوشت.
عاملهای گروه آزاد: پاسخ مثبت به سؤالی دربارهٔ ساختارهای ریاضیِ مرتبط با مکانیک کوانتومی که طبق گزارشها از دههٔ ۱۹۴۰ بیجواب مانده بود.
حدسهای ماهلر در هندسهٔ اجسام محدب و یک نتیجه دربارهٔ سرعت ضرب ماتریسها که عملیات پایهٔ بسیاری از برنامههای کامپیوتری، از جمله خود هوش مصنوعی، است.
این فهرست کامل نیست و هر مورد شرطها و جزئیات فنی خودش را دارد که در عنوانها دیده نمیشود.
چهار ادعای پرسروصدا در یک جدول
ادعا | به زبان ساده | اثبات کامپیوتری (Lean) | وضعیت فعلی |
|---|---|---|---|
شبهفرضیهٔ ریمان (مرز ۷/۸) | ناحیهای بزرگ که تابع زتا در آن هیچ صفری ندارد؛ نه خود فرضیهٔ ریمان | دارد (طبق گزارشها) | ادعا؛ بررسی مستقل تازه شروع شده |
حدس بازیهای یکتا | الگوریتمهای تقریبی فعلی برای خیلی از مسئلهها تقریباً بهتریناند | دارد (طبق گزارشها) | ادعا؛ نیازمند بررسی متخصصان |
حدس هاج برای واریتههای آبلی CM | حالت خاصی از یکی از مسئلههای جایزهٔ هزاره | هنوز ندارد | ادعا؛ احتمالاً ماهها بررسی لازم دارد |
یکسان بودن عاملهای گروه آزاد | جواب «بله» به یک سؤال قدیمی در جبر عملگرها | دارد (طبق گزارشها) | ادعا؛ نیازمند بررسی متخصصان |
ستون Lean بر اساس گزارش OfficeChai و توضیحات مخزن است. فایل رسمی فهرست اثباتها هم وضعیت بازبینی را «بررسینشده» و دامنه را «پیشرفت جزئی» ثبت کرده است.
ماجرا از ناویه-استوکس شروع شد
ادعای شهریور: حل یک مسئلهٔ جایزهٔ هزاره
این انتشار بیمقدمه نبود. OpenAI روز ۱۷ شهریور (۸ سپتامبر) اعلام کرد یک سیستم داخلیاش مسئلهٔ ناویه-استوکس را حل کرده است؛ یکی از مسئلههای جایزهٔ یکمیلیوندلاری هزاره که دربارهٔ معادلههای حرکت سیالات (مثل آب و هوا) است. طبق اثبات منتشرشده، یک سیال که در ابتدا ساکن و کاملاً هموار است، اگر یک نیروی بیرونیِ هموار به آن وارد شود، میتواند در زمان محدود دچار «تکینگی» شود؛ یعنی جایی که معادلهها از کار میافتند.
به گزارش نیوساینتیست، OpenAI برای این کار حدود ۱۰ هزار عامل هوش مصنوعی را همزمان به کار گرفته بود و در نشست خبری گفته بود اجرای همین کار برای یک مشتری حدود ۱۵ میلیون دلار هزینه دارد. خود OpenAI هم نوشت که قصد ندارد جایزهٔ یک میلیون دلاری را مطالبه کند. مارتین بریدسون، رئیس مؤسسهٔ کلی، هم گفته بررسی این ادعا «عمداً بدون عجله» و «کاملاً دقیق» انجام میشود؛ یعنی تا امروز این مؤسسه حکم نهایی نداده است. بخشی از ریاضیدانها هم میگویند استفاده از نیروی بیرونی، مسئله را از آن چیزی که بیشترشان دنبالش بودند دور میکند.
دعوای اعتبار و نامهٔ برندگان مدال فیلدز
همان ادعا با جنجال همراه شد. تریستان باکمستر، استاد دانشگاه نیویورک که با یک پژوهشگر Anthropic روی مسئلهای مشابه کار میکرد، گفت OpenAI بعد از اطلاع از کار آنها سراغ این مسیر رفته است؛ OpenAI این را رد کرد و پس از یک بررسی داخلی گفت پرامپتهای او در Codex هیچ تأثیری روی سیستم نداشته است. چند روز بعد، ۲۰ شهریور (۱۱ سپتامبر)، ۲۵ برندهٔ مدال فیلدز، از جمله ترنس تائو، بیانیهای با عنوان «ناهمراستایی شدید هوش مصنوعی در ریاضیات» منتشر کردند. حرف اصلیشان این بود که مسابقهٔ شرکتها برای حل مسئلههای معروف، روند کند اما ضروری «فهمیدن» ریاضی را دور میزند.
چرا این انتشار جنجالی شد؟
گروه مشورتی چه خواسته بود؟
یک گروه نُهنفره از ریاضیدانها به نام AGMAI (گروه مشورتی ریاضیات و هوش مصنوعی) زیر چتر مؤسسهٔ مطالعات پیشرفتهٔ پرینستون تشکیل شده که اعضایش برای این کار حقوقی نمیگیرند. این گروه ۷ مهر (۲۹ سپتامبر)، با تکیه بر نظر بیش از ۶۰۰ ریاضیدان، توصیههایی برای انتشار نتیجههای ریاضی ساخت هوش مصنوعی منتشر کرد. مهمترینهایش:
نتیجهها در یک مخزن علمی مستقل منتشر شوند، نه در حساب خود شرکت
برای هر نتیجه نام مدل، پرامپت، خلاصهٔ استدلال، زمان و هزینهٔ محاسبه اعلام شود
ریاضی ابزار تبلیغاتی نشود
شرکتها آزمودن مسئلههای پیشرفتهٔ ریاضی روی مدلهای «اختصاصی» و در دسترسنبودهٔ عموم را متوقف کنند
OpenAI کدام را انجام داد و کدام را نه؟
درخواست گروه مشورتی | در انتشار OpenAI |
|---|---|
مخزن مستقل و غیرشرکتی | فعلاً در حساب گیتهاب خود OpenAI؛ میگوید دنبال گزینهٔ مستقل است |
نام مدل | اعلام نشده؛ فقط «مدل داخلی منتشرنشده» |
پرامپت هر نتیجه | منتشر نشده |
خلاصهٔ استدلال | فقط برای ۱۰ نتیجهٔ انتخابی |
زمان و هزینهٔ هر نتیجه | فقط میانگین (حدود سه ساعت فکر ChatGPT Pro)؛ بدون رقم دلاری |
آمار تلاشها | عدد کلی حدود ۴٬۰۰۰ مسئله؛ بدون جدول موفق و ناموفق |
اثبات قابل بررسی با کامپیوتر | برای بسیاری از مقالهها، نه همه |
توقف آزمایش روی مدلهای اختصاصی | رد شد؛ OpenAI میگوید ادامهٔ این ارزیابیها مهم است |
به گزارش Scientific American، سخنگوی OpenAI گفته شرکت توصیهها را جدی میگیرد و تلاش میکند رعایتشان کند، اما ملزم به اجرای آنها نیست. خود گروه مشورتی هم اعلام کرده که نقش مشورتیاش به معنای تأیید مقالهها یا روش OpenAI نیست و انتشار فقط «شروع» بررسی است.
ریاضیدانها چه میگویند؟
بدبینها: «رسید میخواهیم»
اندرو ساترلند، ریاضیدان MIT، به Scientific American گفته تا وقتی مدل منتشر نشود و دیگران نتوانند نتیجهها را تکرار کنند، ادعای «حل یکباره با یک عامل» را باید تأییدنشده دانست. به گفتهٔ او «باید رسید بخواهیم». نگرانی اصلی این است که بدون پرامپتها و آمار دقیق، معلوم نیست مدل برای رسیدن به هر نتیجه چند بار شکست خورده یا چقدر راهنمایی گرفته است. برینا کرا، ریاضیدان دانشگاه نورثوسترن که در نوشتن «اعلامیهٔ لایدن» نقش داشته، هم از شرکتها خواسته بود بهجای پست وبلاگ، مقالههایی بنویسند که ریاضیدانها بتوانند بخوانند و به کار ببرند. این اعلامیه را بیش از ۴٬۰۰۰ ریاضیدان امضا کردهاند.
خوشبینها: «بهتر از پنهان کردن است»
دنیل لیت از دانشگاه تورنتو نگاه دیگری دارد. او به Scientific American گفته اگر میخواهیم جواب این سؤالهای ریاضی را بدانیم، دلیلی نمیبیند که از شرکت بخواهیم آنها را مخفی نگه دارد و به نظرش این برای ریاضیات چیز خوبی است. در واقع پیش از این انتشار، برخی ریاضیدانها از این گلایه داشتند که OpenAI نتیجههایی دارد و منتشرشان نمیکند.
سرعتی که حتی خود شرکت به آن نمیرسد
شاید عجیبترین جملهٔ این ماجرا را سخنگوی OpenAI به Scientific American گفته باشد: بسیاری از نتیجههای تازه را هنوز ریاضیدانهای خود شرکت هم کامل نفهمیدهاند. با این حال OpenAI قصد کند کردن سرعت ندارد. والاستریت ژورنال هم گزارش داده که پیش از انتشار، وقتی شایعهٔ این بستهٔ بزرگ پخش شد، بعضی ریاضیدانها با عجله کارهای خودشان (که با کمک هوش مصنوعی انجام داده بودند) را منتشر کردند تا کسی زودتر از آنها همان نتیجه را اعلام نکند.
«سه ساعت فکر ChatGPT Pro» یعنی چه؟
این عدد در نگاه اول خیلی کم به نظر میرسد، مخصوصاً در مقایسه با ۱۰ هزار عامل و میلیونها دلار هزینهٔ پروژهٔ ناویه-استوکس. اما باید با احتیاط خواندش:
واحد زمان است، نه پول: سه ساعت فکر یعنی مدت محاسبه، نه تعداد پردازندهها یا هزینهٔ دلاری.
میانگین است: برخی نتیجهها شاید خیلی بیشتر یا کمتر وقت گرفته باشند.
با مدل داخلی: مشترکهای ChatGPT Pro به این مدل دسترسی ندارند؛ پس این به آن معنا نیست که شما با اشتراک خود میتوانید همین نتیجهها را بگیرید.
تلاشهای ناموفق معلوم نیست: از حدود ۴٬۰۰۰ مسئله، روشن نیست چند مورد بینتیجه ماند یا چند بار تکرار شد.
با این حال اگر همین ادعا درست باشد، یعنی توان ریاضی سطح پژوهش دیگر لزوماً به صدها میلیون دلار نیاز ندارد. این همان نکتهای است که هم هیجانانگیز است و هم نگرانی ریاضیدانها را بیشتر کرده است.
این ماجرا در تصویر بزرگتر هوش مصنوعی
رقابت OpenAI و Anthropic روی ریاضی
والاستریت ژورنال نوشته OpenAI و Anthropic در ماههای اخیر ریاضیات پیچیده را به نوعی ویترین برای هوشمندترین مدلهایشان تبدیل کردهاند. این رقابت فقط به ریاضی محدود نیست؛ مثلاً Anthropic چندی پیش گزارش داد Claude یک محاسبهٔ بسیار سنگین در فیزیک نظری را انجام داده است. ابزارهایی مثل عاملهای پژوهشی هوش مصنوعی هم نشان میدهند شرکتها میخواهند هوش مصنوعی را از دستیار گفتوگو به «همکار پژوهشی» تبدیل کنند.
مدلی که هنوز نمیشود از آن استفاده کرد
مدلی که این مقالهها را نوشته، نامی ندارد و در دسترس عموم نیست. پیشتر نیوساینتیست گزارش داده بود OpenAI مدل پروژهٔ ناویه-استوکس را «بهطور قابلتوجهی توانمندتر» از GPT-6 Astra توصیف کرده است. OpenAI حالا میگوید در حال کار برای انتشار «مسئولانهٔ» همین مدل است، اما تاریخ یا شرایطی اعلام نکرده است.
بحث شفافیت در OpenAI
این انتشار در هفتهای حساس منتشر شد. چند روز پیشتر، استعفای دیوید رابینسون، مسئول گزارشهای ایمنی OpenAI هم بحث دربارهٔ فرهنگ شفافیت در این شرکت را داغ کرده بود. برخی منتقدان میگویند ماجرای مقالههای ریاضی هم همان الگو را نشان میدهد: انتشار نتیجههای خیرهکننده، بدون همهٔ جزئیاتی که دیگران برای وارسی لازم دارند.
برای ما چه معنایی دارد؟
برای دانشجوها و پژوهشگرهای ریاضی
مقالهها و فایلهای Lean بهصورت عمومی در گیتهاب منتشر شدهاند و به گزارش Kingy با مجوز آزاد Apache 2.0 منتشر شدهاند. برای هر مقاله هم دستور ارجاع آماده گذاشته شده است. برای دانشجوهای تحصیلات تکمیلی، این مجموعه میتواند منبعی برای تمرین، بررسی و حتی پیدا کردن ایراد باشد. فقط یادتان باشد که هنوز نباید به این نتیجهها مثل قضیههای پذیرفتهشده استناد کرد؛ بهتر است همیشه نسخهٔ مقاله و وضعیت بررسی آن را هم ذکر کنید.
برای کاربران عادی هوش مصنوعی
این خبر به این معنا نیست که ChatGPT شما فردا مسئلههای بزرگ ریاضی را حل میکند. مدل مورد استفاده عمومی نیست و نسخههای فعلی هم هنوز در ریاضی اشتباه میکنند. اما نشان میدهد مرز توانایی مدلهای پیشرفته با سرعتی جلو میرود که حتی متخصصان را غافلگیر کرده است. اگر نسخهای از این مدل عرضه شود، احتمالاً اول به پژوهشگرها و مشترکهای گرانتر میرسد.
چه چیزهایی هنوز معلوم نیست؟
درستی تکتک نتیجهها: برای مقالههای بدون اثبات Lean، بررسی انسانی ممکن است ماهها طول بکشد.
میزان تازگی: باید روشن شود کدام اثباتها ایدهٔ واقعاً نو دارند و کدام بیشتر ترکیبی از روشهای شناختهشدهاند.
سهم انسان: OpenAI یک مورد ویرایش انسانی را اعلام کرده، اما معلوم نیست در بقیه چه مقدار دخالت انسانی بوده است.
اعتبار علمی و جایزهها: قواعد جایزههای بزرگی مثل جایزهٔ هزاره برای اثباتهای ساخت هوش مصنوعی هنوز تجربه نشده است.
زمان عرضهٔ مدل: OpenAI تاریخی برای در دسترس قرار دادن مدل اعلام نکرده است.
سؤالهای پرتکرار
آیا OpenAI فرضیهٔ ریمان را حل کرد؟
نه. ادعای OpenAI نسخهٔ ضعیفتری است که «شبهفرضیهٔ ریمان» نامیده میشود: اینکه تابع زتا در ناحیهٔ مشخصی (بخش حقیقی بیشتر از ۷/۸) صفر ندارد. این نتیجه، اگر تأیید شود، مهم است اما خود فرضیهٔ ریمان نیست و جایزهٔ هزاره ندارد.
این ۷۲۲ مقاله را کجا میشود دید؟
در مخزن عمومی openai/math در گیتهاب. فهرست کلی، فایل PDF مقالهها، اثباتهای Lean و ۱۰ خلاصهٔ استدلال مدل آنجا قرار دارد.
آیا همهٔ این نتیجهها درستاند؟
معلوم نیست. اثباتهایی که در Lean چک شدهاند احتمال خطای منطقی خیلی کمی دارند، به شرط اینکه صورت مسئله درست نوشته شده باشد. خود OpenAI گفته برخی نتیجههای بدون اثبات کامپیوتری ممکن است ایراد داشته باشند.
میتوانم با ChatGPT همین کار را بکنم؟
نه با همین کیفیت. نتیجهها با یک مدل داخلی و منتشرنشده به دست آمدهاند. عبارت «سه ساعت فکر ChatGPT Pro» فقط واحدی برای اندازهٔ محاسبه است و به معنای دسترسی کاربران Pro به این مدل نیست.
چرا بعضی ریاضیدانها از این انتشار ناراضیاند؟
چون مدل، پرامپتها و هزینهٔ هر نتیجه منتشر نشده و بار سنگین بررسی صدها مقاله روی دوش جامعهٔ ریاضی افتاده است. گروه مشورتی AGMAI دقیقاً همین جزئیات را خواسته بود.
OpenAI برای این نتیجهها جایزه میگیرد؟
OpenAI دربارهٔ ناویه-استوکس صریحاً گفته جایزهٔ هزاره را مطالبه نمیکند. برای نتیجههای تازه حرفی از جایزه نزده است. ضمن اینکه طبق قواعد مؤسسهٔ کلی، هر راهحل باید منتشر شود، دستکم دو سال بماند و از سوی جامعهٔ ریاضی پذیرفته شود.
چرا این خبر برای کسی که ریاضیدان نیست مهم است؟
چون ریاضی یکی از سختترین آزمونهای «فکر کردن» است. اگر یک مدل بتواند در ریاضی سطح پژوهش کار جدی انجام دهد، احتمالاً در کارهای علمی و فنی دیگر هم تحول ایجاد میکند؛ و همین، پرسش دربارهٔ کنترل، شفافیت و سهم انسان را مهمتر میکند.
منابع
Scientific American — OpenAI unleashes hundreds more math results upon a field already in shock
TokenPost — OpenAI Releases 722 AI-Generated Math Manuscripts After Criticism
OpenAI — On the Navier–Stokes Millennium Prize Problem (۸ سپتامبر ۲۰۲۶)
A Severe Misalignment of AI in Mathematics — متن بیانیهٔ برندگان مدال فیلدز




