طرح سهبخشی آنتروپیک برای مهار ریسک هوش مصنوعی
خلاصهٔ کاملتر
داریو آمودی، مدیرعامل Anthropic، مقالهای منتشر کرده به اسم «We Must Pace the Frontier» و توش یه طرح سهبخشی داده برای کم کردن سرعت پرریسکترین بخشهای توسعهٔ هوش مصنوعی، بدون اینکه کل پیشرفت کند بشه. مقاله آخر هفته منتشر شد و ظرف چند روز تقریباً همهٔ مدیرعاملهای آزمایشگاههای بزرگ و کاخ سفید بهش واکنش نشون دادن.
بخش اول ارزیاب مستقرشدهست (embedded evaluator، یعنی ارزیاب بیرونی که مثل کارمند داخلی کارت ورود و لپتاپ و دسترسی میگیره). هدف اینه که ارزیاب واقعاً ببینه مدل موقع توسعه چه رفتاری داره، نه اینکه بعداً یه گزارش تمیزشده بخونه. Anthropic میگه مستقل از اینکه بقیه چیکار کنن، خودش این کارو انجام میده.
بخش دوم قانونگذاری در آمریکاست که شامل همهٔ آزمایشگاههای مرزی بشه، حتی اونهایی که داوطلبانه قبول نمیکنن. ولی دامنهش عمداً باریکه: کنترل صادرات تراشه و تجهیزات ساخت نیمههادی به چین، برخورد با قاچاق سختافزار، جلوگیری از distillation غیرمجاز (یعنی تربیت یه مدل جدید از روی خروجی و استدلال یه مدل بزرگتر) توسط شرکتهای کشورهای اقتدارگرا، و امنیت بیشتر برای جلوگیری از دزدی وزنهای مدل. یعنی قانونگذاری حول امنیت ملی، نه محدودیت عمومی روی AI.
بخش سوم هماهنگی جهانیه که خود آمودی سختترین و دورترین بخش میدونه. اینجا پای همکاری با چین وسط میاد: تعهد مشترک برای استفاده نکردن از AI تو ساخت سلاح بیولوژیک، توافق برای تست کردن مدلهای همدیگه قبل از انتشار، و یه جور سقف سرعت روی recursive self-improvement (یعنی وقتی از یه مدل برای تربیت نسل بعدی خودش استفاده میشه).
واکنشها سریع و عمومی بود. سم آلتمن گفت موافقه و OpenAI هم مدل ارزیاب مستقر رو قبول میکنه و بهش گفت «ایدهٔ عالی». دمیس هسابیس گفت مقاله «مسیر درست رو نشون میده» ولی جزئیاتش هنوز باید باز بشه. ساتیا نادلا از ایدهٔ ارزیاب مستقر استقبال کرد. مارک زاکربرگ تنها مخالف بود: میگه هر آزمایشگاه خودش انگیزه و مسئولیت کافی داره، ایجنت ناهمراستا اصلاً کاربر جذب نمیکنه، پس فراخوان عمومی برای قانونگذاری لازم نیست.
ترامپ کل موج نگرانی ایمنی رو «هوکس» و توطئهای به نفع چین خوند و گفت دولت همین الان قدرت کیفری و نظارتی کافی روی این شرکتها داره. نویسنده میگه اهمیت ماجرا فراتر از جنجال شبکههای اجتماعیه: تأیید سریع ایدهٔ ارزیاب مستقر از طرف OpenAI و DeepMind و مایکروسافت یعنی ممکنه به یه نُرم صنعتی تبدیل بشه، و مخالفت زاکربرگ یعنی ریسک اینکه «همراستایی» چیزی بشه که هر شرکت خودش تعریف و کنترلش کنه.
نکات کلیدی:
- طرح سه بخش داره: ارزیاب مستقرشده، قانونگذاری آمریکایی برای همهٔ آزمایشگاههای مرزی، و هماهنگی جهانی.
- Anthropic میگه ارزیاب مستقر رو مستقل از تصمیم بقیهٔ آزمایشگاهها اجرا میکنه.
- خواستههای قانونی محدود میشه به کنترل صادرات تراشه به چین، مقابله با قاچاق، محدود کردن distillation غیرمجاز و امنیت وزنهای مدل.
- OpenAI اعلام کرد مدل ارزیاب مستقر رو قبول میکنه؛ DeepMind و مایکروسافت هم استقبال کردن.
- زاکربرگ گفت Meta هم الان از ارزیاب مستقل استفاده میکنه ولی فراخوان عمومی برای قانونگذاری لازم نمیدونه.
- ترامپ نگرانی ایمنی رو رد کرد و رقابت با چین رو اولویت اعلام کرد.




