شرکت OpenAI در تازهترین اقدام خود، مجموعهای متشکل از ۷۲۲ نسخه پیشنویس علمی را در گیتهاب منتشر کرده است که شامل راهحلها و پیشرفتهای قابلتوجه در ۳۷۲ مسئله دشوار ریاضی است. این اقدام که بازتاب گستردهای در جامعه علمی داشته، بار دیگر پرسشهای بنیادین درباره توانایی هوش مصنوعی در استدلالهای منطقی و دقت علمی را به میان آورده است.
معماری دستیابی به راهکارها: فراتر از محاسبات ساده
طبق گزارشهای منتشر شده در پاییز ۱۴۰۳، این دستاوردها توسط یک مدل آزمایشی و معرفینشده از خانواده ChatGPT حاصل شدهاند. آنچه این نتایج را متمایز میکند، رویکرد «یکبار پرسش» (Single-prompt) است؛ به این معنا که تقریباً تمامی مقالات ارائهشده در پاسخ به تنها یک دستورالعمل (Prompt) توسط یک ایجنت هوش مصنوعی تولید شدهاند. OpenAI مدعی است که هر نتیجه بهطور متوسط به حدود سه ساعت پردازش توسط سرویس ChatGPT Pro نیاز داشته است.
چالشها و حواشی علمی: از فرضیه ریمان تا Navier-Stokes
این انتشار مستندات، شامل دستاوردهای بزرگی همچون حل حدس Kakeya در فضای چهاربعدی و پیشرفتهای ملموس در فرضیه بسیار دشوار «ریمان» (Riemann hypothesis) است. با این حال، جامعه ریاضیدانان همچنان با دیده تردید به این موضوع مینگرد. تجربه پیشین مربوط به جنجالهای پیرامون معادلات «نویه-استوکس» (Navier-Stokes) باعث شده تا دانشمندان برجستهای نظیر «اندرو ساترلند» از MIT، خواستار شفافیت بیشتر در مورد مدلها و امکان بازتولید نتایج (Reproducibility) توسط جوامع علمی مستقل باشند.
نقش گروه مشاوران AGMAI و استانداردهای انتشار
OpenAI برای کاهش انتقادات، از دستورالعملهای «گروه مشاوران ریاضی و هوش مصنوعی» (AGMAI) پیروی کرده است. این پروتکلها شامل انتشار سریع نتایج در مجاری آکادمیک و ارائه جزئیات پیرامون ماهیت مدل و هزینههای محاسباتی است. با این حال، شرکت در بخشهایی از توصیهها کوتاهی کرده؛ بهطوری که زمان دقیق محاسبات برای هر مسئله و پرامپتهای دقیق مورد استفاده به صورت کامل فاش نشده است که این خود مانعی برای ارزیابی دقیق توسط محققان مستقل محسوب میشود.
مشخصات فنی و آماری خروجی اخیر
- تعداد مستندات: ۷۲۲ مقاله پیشنویس
- تعداد مسائل ریاضی پوشش داده شده: ۳۷۲ مسئله
- متوسط زمان پردازش برای هر نتیجه: حدود ۳ ساعت استفاده از ChatGPT Pro
- متدولوژی: تولید پاسخ در پاسخ به یک پرامپت واحد (One-shot agent response)
- دسترسی: مخزن رسمی OpenAI در گیتهاب
چشمانداز آینده و ضرورت بازبینی
تا زمانی که جامعه ریاضیدانان فرصت کافی برای بررسی و تایید این نتایج را نداشته باشند، این دستاوردها تنها در سطح ادعاهای «اثباتنشده» باقی خواهند ماند. OpenAI متعهد شده است که در انتشارهای آتی، کیفیت مقالات از نظر ارجاعات و نحوه نمایش منطق ریاضی را بهبود بخشد. گذار از «تولید متن» به «اثبات علمی»، بزرگترین آزمون برای هوش مصنوعی در سالهای پیش رو خواهد بود.