SEC-AF؛ ممیز امنیتی متنبازی که اکسپلویت رو اثبات میکنه
خلاصهٔ کاملتر
ایدهٔ اصلی SEC-AF سادهست: ابزارهای معمول الگو تشخیص میدن، ولی این یکی میخواد قابل بهرهبرداری بودن رو اثبات کنه. به نوشتهٔ مخزن، هر یافته با یه حکم مشخص (confirmed، likely، inconclusive، not_exploitable)، یه شیء proof شامل ردّ کامل جریان دادهٔ آلوده، و محل دقیق کد بیرون میاد. پروژه متنباز و تحت Apache 2.0ـه، روی AgentField اجرا میشه و کل ممیزی با یه فراخوانی — یه دستور CLI یا یه درخواست HTTP — راه میافته.
معماری چیزیه که پروژه بهش میگه Composite Intelligence. هر فاز یه reasoner ـه که زیرمجموعههای خودش رو صدا میزنه و در نهایت یه گراف بدون دور از فراخوانیها ساخته میشه. خط لوله چهار مرحله داره: RECON برای نقشهٔ معماری و وابستگیها، HUNT با بیش از ده استراتژی تخصصی، PROVE برای راستیآزمایی و REMEDIATION برای پیشنهاد اصلاح. هر فاز موازی اجرا میشه و بهصورت جریانی با فاز بعدی همپوشانی داره.
نکتهٔ اصلی طراحی، کشمکش عمدی بین ایجنتهاست. شکارچیها انگیزه دارن آسیبپذیری پیدا کنن و اثباتکنندهها انگیزه دارن ردش کنن؛ هر یافته از یه زنجیرهٔ چهار ایجنته رد میشه که یکی جریان داده رو بازسازی میکنه، یکی دنبال سازوکارهای پاکسازیه، یکی سناریوی حمله میسازه و آخری بین شواهد متناقض حکم میده. به گفتهٔ نویسنده، همین ساختار — نه پرامپت بهتر — عامل کاهش ۹۴ درصدی نویزه.
تو بنچمارک روی Damn Vulnerable GraphQL Application، ۱۰۶ یافتهٔ خام بعد از حذف تکراریها به ۶۱ تا و بعد از راستیآزمایی تخاصمی به ۲۸ یافتهٔ تأییدشده رسیده؛ حدود ۷۸ دقیقه زمان و به تخمین خود پروژه بین ۰.۱۸ تا ۰.۹۰ دلار هزینهٔ LLM. دستهبندی یافتهها هم از نبود احراز هویت و تزریق فرمان تا رمزهای متنساده و پیکربندی ناامن رو پوشش میده.
مخزن دربارهٔ محدودیتهاش هم صریحه: ۹ سناریویی که از قلم افتاده عمدتاً حملههای سطح پروتکل GraphQL هستن — کوئری دستهای، بازگشت عمیق، سوءاستفاده از alias — که تحلیل ایستا بهشون نمیرسه و به آزمون پویا نیاز دارن. نویسندهها هم میپذیرن Semgrep و CodeQL سالها پوشش قاعدهمحور آزمودهشده روی زبانهای بیشتری دارن و SEC-AF فعلاً فقط تو تحلیل کد با کمک هوش مصنوعی جلوتره.
نکات کلیدی:
- هر یافته با حکم، شیء proof و ردّ جریان داده بیرون میاد، نه فقط یه هشدار الگویی
- معماری از حدود ۲۰۰ تا ۳۰۰ فراخوانی کوچیک LLM با اسکیمای دو تا چهار فیلدی ساخته شده
- جدایی ساختاری HUNT و PROVE عامل کاهش ۹۴ درصدی نویزه
- بنچمارک DVGA: ۱۰۶ یافتهٔ خام به ۲۸ یافتهٔ تأییدشده رسید، با هزینهٔ تخمینی زیر یک دلار
- خروجی SARIF 2.1.0 و نگاشت انطباق با PCI-DSS، SOC2، OWASP و HIPAA داره
- ضعف فعلی: حملههای سطح پروتکل GraphQL که به تحلیل پویا نیاز دارن پوشش داده نمیشن




