وقتی ChatGPT 5.5 Pro یک تحقیق دکترا را در یک ساعت حل کرد
خلاصهٔ کاملتر
تیموتی گاورز، ریاضیدان برندهی جایزهی فیلدز، در وبلاگش نوشته که ChatGPT 5.5 Pro یک مسئلهی باز در نظریهی اعداد افزایشی (Additive Number Theory) را در حدود یک ساعت حل کرده، بدون اینکه او هیچ ورودی ریاضی جدی داشته باشه. این تجربه باعث شده که ارزیابیاش از تواناییهای ریاضی مدلهای زبانی بزرگ (LLM) را بهطور قابل توجهی بالا ببره.
مسئله از مقالهای توسط مل ناتانسون برگرفته شده بود. موضوع اینه که اگر یک مجموعه از اعداد صحیح داشته باشیم، «مجموعهی جمع» (sumset) آن یعنی همهی اعدادی که میشه با جمع دو عضو از این مجموعه ساخت. ناتانسون پرسیده بود که حداقل چه قطری (diameter) لازمه تا بتونیم یک مجموعه با اندازهی مشخص و sumset با اندازهی مشخص بسازیم. او خودش یک کران بالا اثبات کرده بود و پرسیده بود آیا میشه بهترش کرد.
مدل ۱۷ دقیقه و ۵ ثانیه «فکر» کرد و بعد یک ساختار ارائه داد که کران بالای درجهدوم (quadratic upper bound) میده — و این بهترین حالت ممکنه. ایدهی اصلی ترکیب یک مجموعهی سیدون (Sidon set — مجموعهای که sumset آن بیشترین اندازهی ممکن را داره) با یک تصاریف حسابی بود. ناتانسون هم از ایدهی مشابهی استفاده کرده بود، اما ChatGPT با انتخاب یک مجموعهی سیدون کارآمدتر نتیجهی بهتری گرفت.
گاورز بعد از اثبات نتیجه برای sumset معمولی، از مدل خواست همین کار را برای restricted sumset (که در آن هر عضو فقط یکبار میتونه استفاده بشه) هم انجام بده. مدل بدون مشکل این کار را هم کرد. در پایان هم از مدل خواست نتایج را بهصورت یک پیشچاپ (preprint) در قالب LaTeX بنویسه، که ظرف ۲ دقیقه و ۲۳ ثانیه آن را تحویل داد.
نکتهای که گاورز روی آن تأکید داره اینه که LLMها الان به جایی رسیدن که اگر یک مسئله یک «استدلال آسان» داشته باشه که ریاضیدانهای انسانی از قلم انداختن، هوش مصنوعی احتمالاً آن را پیدا میکنه. این یعنی دیگه صرف «باز بودن» یک مسئله کافی نیست — باید بهاندازهی کافی سخت باشه که LLM نتونه حلش کنه.
نکات کلیدی:
- ChatGPT 5.5 Pro یک مسئلهی باز در نظریهی اعداد افزایشی را با کیفیت پژوهش دکترا حل کرد
- مدل کران بالای درجهدوم برای قطر مجموعه ساخت که بهینهترین نتیجه ممکنه
- ایدهی اصلی ترکیب مجموعهی سیدون با تصاریف حسابی بود
- نتیجه را بهصورت خودکار در قالب LaTeX پیشچاپ علمی نوشت
- گاورز هشدار میده که میزان سختی مسائل تحقیقاتی برای دانشجویان باید از این پس بالاتر باشه




