هوش مصنوعی تا کجا میتونه آینده رو پیشبینی کنه؟
خلاصهٔ کاملتر
اسکات الکساندر تو وبلاگ Astral Codex Ten سراغ یک سؤال ساده رفته: پیشبینی رویدادهای جهان چقدر جا برای بهتر شدن داره؟ مدلهای هوش مصنوعی تازگی به دقت بهترین پیشبینهای انسانی نزدیک شدن، پس یا انسانها عملاً به مرز پیشبینیپذیری رسیدن و مدلها همونجا فلات میکنن، یا خط روند ادامه پیدا میکنه و خیلی جلوتر میرن. نویسنده حدود ۷۰-۳۰ روی حالت دوم شرط میبنده.
طرف مقابل، دنیل ریوز، به مطالعهای از ۲۰۱۰ استناد میکنه که نشون میداد بازارهای پیشبینی فقط ۳ تا ۶ درصد از مدلهای آماری ساده بهتر عمل میکنن. الکساندر میگه این عدد گمراهکنندهست، چون خطای RMSE هست نه درصد برد: تو دادههای فوتبال آمریکایی همون بهبود، نصف کل تفاوتیه که «دونستن اینکه اصلاً کدوم دو تیم بازی میکنن» ایجاد میکنه. به گفتهٔ او ورزش عمداً طوری طراحی شده که غیرقابلپیشبینی باشه — سقف حقوق، سیستم درفت و زمین متقارن همه برای همینه.
وقتی سراغ ژئوپلیتیک میره، فاصلهٔ بین حدس تصادفی و پیشبینهای حرفهای Metaculus حدود سه برابر چیزیه که یک انتقال سرراست از مدل ریوز پیشبینی میکرد؛ یعنی اون سقف ادعایی همین حالا هم شکسته شده. نویسنده میگه درس واقعی مطالعهٔ ریوز این نیست که پیشرفت تموم شده، فقط اینه که نباید منتظر معجزه بود.
برای تخمین سقف واقعی سه لنگر میذاره: اگر برتری هوش مصنوعی بر انسان به اندازهٔ برتری بازارهای پیشبینی بر مدلهای ساده باشه، امتیاز حدود ۵۶ درمیاد؛ اگر به اندازهٔ برتری تیم Samotsvety بر سوپرفورکسترهای معمولی باشه، حدود ۶۵؛ و اگر مثل شطرنج باشه — جایی که موتورها الان با ۲.۴ پیاده هندیکپ هم انسان رو میبرن — حدود ۸۵.
ترجمهٔ عملی این اعداد اینه: روی بازاری که الان روی ۵۰ درصد ایستاده، بهترین هوش مصنوعی ممکن بهطور میانگین بین ۵۴ تا ۶۲ درصد میگه، یعنی ۴ تا ۱۲ واحد درصد دقت بیشتر. الکساندر میگه شاید کم به نظر برسه، ولی دقیقاً همون چیزیه که آدم موقع تصمیمگیری دنبالشه؛ تازه پیشبین بهتر تو پیدا کردن سؤالهای درست و ساختن سیاست بهتر هم اثر میذاره.
نکات کلیدی:
- مدلهای هوش مصنوعی تو پیشبینی رویدادها به سطح بهترین انسانها رسیدن و سؤال اینه که فلات میکنن یا نه
- برتری ۳ تا ۶ درصدی بازارهای پیشبینی تو مطالعهٔ ۲۰۱۰ کوچک به نظر میاد، ولی مقیاسش گمراهکنندهست
- ورزش عمداً برای مقاومت در برابر پیشبینی طراحی شده، برخلاف ژئوپلیتیک
- سه لنگر مقاله سقف امتیاز هوش مصنوعی رو ۵۶، ۶۵ یا ۸۵ تخمین میزنه
- عملاً یعنی ۴ تا ۱۲ واحد درصد دقت بیشتر روی بازارهای پیشبینی




