security-audit: ممیزی امنیتی کد با ایجنتهای موازی
خلاصهٔ کاملتر
Cloudflare یه اسکیل به اسم security-audit منتشر کرده که ایجنت کدنویس رو به یه ممیز امنیتی تبدیل میکنه. به گفتهی خودشون، این همون اسکیلیه که هستهی «harness کشف آسیبپذیری» Cloudflare ازش جوونه زده؛ اون سیستم بعداً به یه سازوکار چندمرحلهای و در سطح کل ناوگان تبدیل شده، ولی این اسکیل همون نقطهی شروع تکمخزنیشه.
کاری که اسکیل میکنه اینه که یه ممیزی رو تو شش فاز پشت سر هم میبره. اول فاز شناسایی، که چند ایجنت پژوهشی موازی معماری برنامه، مرزهای اعتماد و سطوح ورودی رو نقشه میکنن. بعد فاز شکار، که ایجنتها از زاویههای مختلف مثل تزریق، کنترل دسترسی، منطق کسبوکار و رمزنگاری به کد حمله میکنن و هر کدوم میتونن زیرایجنت بسازن تا عمیقتر برن.
سه فاز بعدی روی درست بودن یافتهها تمرکز دارن. تو فاز اعتبارسنجی، ایجنتهای جدا سعی میکنن هر یافته رو رد کنن تا مثبتهای کاذب حذف بشن. فاز گزارش دو تا خروجی خوانا برای آدم میسازه، و فاز خروجی ساختارمند یه فایل findings.json تولید میکنه که با یه اسکیمای مشخص اعتبارسنجی میشه. آخرش هم فاز راستیآزمایی مستقل، که ایجنتهای تازه هر ادعای واقعی تو خروجی رو با خود سورسکد چک میکنن.
فلسفهی پشت این اسکیل چند تا اصل روشن داره. نویسندهها میگن فقط چیزی رو گزارش بده که بتونی اکسپلویتش کنی؛ هر یافته به یه سناریوی حملهی مشخص نیاز داره، نه یه «از نظر تئوری ممکنه». شدت هر مورد هم از ضرب احتمال در تأثیر میاد، نه از فاصلهی کد با یه چکلیست. یه نکتهی مهم دیگه اینه که ایجنت بررسیکننده هیچوقت همون ایجنت پیداکننده نیست، تا بررسی خصمانه بمونه.
به گفتهی Cloudflare، چند بار اجرا روی یه مخزن، نتیجه رو کاملتر میکنه؛ آزمایشهاشون نشون داده یه اجرای تنها فقط حدود نصف آسیبپذیریها رو پیدا میکنه، و هر اجرا مسیرهای کد متفاوتی رو میکاوه. جالبه که اجراها روی هم اضافه میشن: اسکیل فایلهای findings.json قبلی رو میخونه تا مشکلات شناختهشده رو رد کنه و سراغ شکافها بره. برای کار کردنش هم به یه ایجنت با پشتیبانی از ابزار و زیرایجنت موازی و به Node.js نیاز داری.
نکات کلیدی:
- اسکیل security-audit از Cloudflare، ایجنت کدنویس رو به یه ممیز امنیتی چندایجنتی تبدیل میکنه
- خط لولهی ششفازی: شناسایی، شکار، اعتبارسنجی، گزارش، خروجی ساختارمند و راستیآزمایی مستقل
- اصل کلیدی: فقط آسیبپذیری قابل اکسپلویت گزارش میشه، نه ضعفهای صرفاً تئوری
- اعتبارسنجی خصمانه: ایجنتی که یافته رو چک میکنه همون ایجنت پیداکننده نیست
- چند بار اجرا پوشش رو بیشتر میکنه؛ یه اجرای تنها حدود نصف باگها رو پیدا میکنه




