موزیلا: ۲۷۱ آسیبپذیری فایرفاکس با هوش مصنوعی، تقریباً بدون خطای کاذب
خلاصهٔ کاملتر
ماه گذشته مدیر ارشد فناوری موزیلا ادعا کرد که با کمک هوش مصنوعی، «روزهای زیرو-دی شمارش معکوسشون شروع شده.» این حرف با موج گستردهای از شک و تردید روبرو شد؛ چون الگوی آشنایی داشت: چند نتیجه چشمگیر رو برجسته کن، جزئیات رو پنهان کن، و بذار قطار هایپ حرکت کنه.
حالا موزیلا در یه پست مفصل توضیح داده که این ۲۷۱ آسیبپذیری طی دو ماه چطور پیدا شدن. دو عامل اصلی موفقیت بودن: بهتر شدن خود مدلهای هوش مصنوعی، و ساخت یه هارنس سفارشی که به مدل کمک میکرد کد فایرفاکس رو هدفمند آنالیز کنه. هارنس (agent harness) در واقع یه لایه کد دور مدل زبانی هست که اون رو گامبهگام در انجام یه وظیفه مشخص هدایت میکنه.
برایان گرینستد، مهندس ارشد موزیلا، توضیح داد که تجربههای قبلی با ابزارهای مشابه پر از «اسلاپ» بود — یعنی گزارشهایی که ظاهر معقولی داشتن ولی جزئیاتشون توسط مدل ساختهوپرداخته شده بود و وقت زیادی از توسعهدهندههای انسانی میگرفت. تفاوت این بار در هارنسی بود که تیمش ساخت.
گرینستد میگه هارنس به مدل ابزارهای واقعی مورد استفاده توسعهدهندههای موزیلا رو میده؛ از جمله نسخه خاصی از فایرفاکس برای تست. مدل یه فایل سورس میگیره، تستکیس میسازه، میفرسته به سیستم، و جواب میگیره که آیا مشکل وجود داره یا نه. اگر اکسپلویت موفق باشه، یه مدل زبانی دوم خروجی رو ارزیابی و تأیید میکنه. این تأیید دوگانه باعث میشه اعتماد به گزارشها در حد همون روشهای سنتی کشف باگ باشه.
از ۲۷۱ باگ کشفشده، ۱۸۰ مورد با درجه sec-high (بالاترین رتبه برای باگهای داخلی) طبقهبندی شدن — یعنی آسیبپذیریهایی که صرفاً با باز کردن یه صفحه وب میشه ازشون سوءاستفاده کرد. موزیلا ۱۲ تا از این گزارشها رو عمومی کرد که یه محقق امنیتی گفت «کاملاً قابلتوجه» به نظر میرسن.
با این حال انتقادها هنوز ادامه داره. منتقدان میپرسن موزیلا در ازای این تعریفوتمجید از Mythos چه چیزی دریافت میکنه، و احتمالاً اون ۱۲ گزارش عمومیشده رو هم گزینششده میدونن. گرینستد میگه انگیزهشون سادهست: تیمشون به این روش باور داره و میخوان بحث رو در جامعه امنیتی جدیتر کنن — نه تبلیغ یه شرکت خاص.
نکات کلیدی:
- موزیلا با هوش مصنوعی Mythos ساخت Anthropic طی دو ماه ۲۷۱ آسیبپذیری فایرفاکس کشف کرد
- کلید موفقیت، ساخت یه هارنس سفارشی بود که مدل رو در تحلیل کد هدایت میکنه
- یه مدل LLM دوم خروجی مدل اول رو تأیید میکنه تا گزارشهای کاذب حذف بشن
- ۱۸۰ باگ از ۲۷۱ مورد، درجه sec-high داشتن
- موزیلا ۱۲ گزارش کامل رو عمومی کرد اما جامعه امنیتی همچنان منتقد باقی مونده




