اوپنایآی ۷۲۲ دستنوشتهٔ ریاضی تولیدشده با هوش مصنوعی را در گیتهاب منتشر کرد
اوپنایآی ۷۲۲ دستنوشتهٔ ریاضی حاصل کار یک مدل منتشرنشده را در گیتهاب گذاشت؛ ادعاهایی بزرگ که هنوز باید بهطور مستقل راستیآزمایی شوند.
شرکت OpenAI روز چهارشنبه ۱۵ مهر ۱۴۰۵ (۷ اکتبر ۲۰۲۶) مجموعهای از ۷۲۲ دستنوشتهٔ ریاضی را در یک مخزن عمومی گیتهاب منتشر کرد. به گزارش Engadget، این دستنوشتهها حاصل کار یک مدل داخلی و هنوز منتشرنشدهٔ ChatGPT است و به گفتهٔ شرکت، راهحل یا پیشرفت در ۳۷۲ مسئلهٔ مهم ریاضی را در بر میگیرد.
چه چیزی منتشر شده است؟
طبق گزارشها، حدود ۴٬۰۰۰ مسئله به این مدل داده شد و تقریباً همهٔ نتایج با یک پرامپت و توسط یک عامل (Agent) هوش مصنوعی به دست آمده است. OpenAI میگوید هر نتیجه بهطور میانگین حدود سه ساعت پردازش در سطح ChatGPT Pro مصرف کرده است. از جمله ادعاهای مطرحشده، حل حدس کاکیا (Kakeya) در چهار بعد و نتیجهای مرتبط با فرضیهٔ ریمان است؛ به نوشتهٔ GadgetReview، این نتیجهٔ دوم یک «ناحیهٔ بدون صفر» با بخش حقیقی بزرگتر از ۷/۸ است که از خود فرضیهٔ ریمان بسیار ضعیفتر است. بسیاری از دستنوشتهها با زبان اثباتسنج Lean صوریسازی شدهاند، اما نه همهٔ آنها.
چرا باید با احتیاط نگاه کرد؟
این نتایج هنوز بهطور گسترده توسط ریاضیدانان مستقل تأیید نشده است. OpenAI استدلالهای مدل و برآوردهای کلی محاسبات را منتشر کرده، اما پرامپتها و زمان محاسبه به تفکیک هر مسئله را منتشر نکرده است؛ کاری که یک گروه مشورتی مستقل توصیه کرده بود. اندرو ساترلند (Andrew Sutherland)، ریاضیدان MIT، به Engadget گفته است تا زمانی که مدل منتشر و نتایج تکرار نشود، ادعای حل مسائل با یک پرامپت باید «تأییدنشده» تلقی شود. همچنین یادآوری میشود که ادعای پیشین مرتبط با معادلات ناویر–استوکس با بحث و تردید همراه بود.
چرا مهم است؟
اگر بخش قابلتوجهی از این نتایج درست از آب درآید، نشانهٔ جهشی در توان مدلهای زبانی برای پژوهش ریاضی خواهد بود. در عین حال، انتشار یکجای صدها مقاله بار سنگینی بر دوش جامعهٔ ریاضی برای داوری میگذارد و پرسش دربارهٔ شفافیت و تکرارپذیری پژوهشهای مبتنی بر هوش مصنوعی را پررنگتر میکند.