شرکت OpenAI به تازگی صدها راهحل و پیشرفت در ۳۷۲ مسئله مهم ریاضی را در قالب ۷۲۲ مقاله در گیتهاب منتشر کرده است. این نتایج حاصل کار یک مدل پیشرفته و منتشرنشده از خانواده ChatGPT است که توسط گروه مشورتی جدید OpenAI تایید شدهاند و احتمالاً بحثهای گستردهای را در جامعه ریاضی به دنبال خواهد داشت.
OpenAI پیشتر اعلام کرده بود که مدلهایش توانستهاند بیش از ۱۰۰ مسئله قدیمی و حلنشده در حوزههای مختلف ریاضی را پاسخ دهند. در این انتشار، شرکت اطلاعاتی درباره استدلالهای مدل، تخمینهای محاسباتی و تعداد مسائل حل شده نیز ارائه کرده است. به گفته OpenAI، هر نتیجه به طور متوسط حدود سه ساعت استفاده از نسخه حرفهای ChatGPT نیاز داشته است.
این شرکت اعلام کرد که انتشار مقالات مطابق با دستورالعملهای گروه مشورتی مستقل ریاضی و هوش مصنوعی (AGMAI) انجام شده است. این دستورالعملها شامل انتشار سریع نتایج از طریق کانالهای علمی سنتی و ارائه جزئیاتی مانند نام مدل استفاده شده، پرسشهای مطرح شده و هزینههای محاسباتی است. OpenAI همچنین اعلام کرده که نتایج را در مخزن گیتهاب منتشر کرده و پروتکلهایی برای بازبینی و ارجاع مقالات در نظر گرفته است. این شرکت در آینده قصد دارد کیفیت مقالات را با بهبود ارجاعات، توضیحات ریاضی و ارائه بهتر نتایج ارتقا دهد.
با این حال، OpenAI برخی از پیشنهادات گروه مشورتی را نادیده گرفته است؛ از جمله عدم انتشار زمان دقیق محاسبات برای هر مسئله و پرسشهای مشخص شده. از جمله نتایج کلیدی که OpenAI ادعا کرده میتوان به حل حدس کاکه چهاربعدی، بهبود الگوریتمهای کامپیوتری مهم و پیشرفت در مسئله بسیار دشوار حدس ریمان اشاره کرد.
تقریباً همه مقالات در پاسخ به یک پرسش واحد توسط یک عامل هوش مصنوعی تولید شدهاند. OpenAI به مجله Scientific American گفته است که این نتایج هنوز باید توسط ریاضیدانان مورد ارزیابی قرار گیرند تا تاثیر واقعی آنها مشخص شود. پس از جنجال مربوط به مسئله ناویر-استوکس، جامعه علمی همچنان نسبت به این ادعاها با شک و تردید برخورد میکند.
اندرو ساترلند، ریاضیدان مؤسسه فناوری ماساچوست، در گفتوگو با Scientific American بیان کرده است که تا زمانی که مدل منتشر نشود و دیگران نتوانند نتایج را بازتولید کنند، باید ادعاهای حل مسائل تنها با یک پرسش و یک عامل هوش مصنوعی را تاییدنشده دانست.
