ADR اوبر: نگهبان امنیتی ایجنتهای هوش مصنوعی
خلاصهٔ کاملتر
اوبر سیستم امنیتی خودش برای ایجنتهای هوش مصنوعی رو با اسم ADR (مخفف Agentic AI Detection and Response) متنباز کرده. تو مستندات پروژه اومده که ADR هم برای ایجنتهای داخلی و کارمندمحور مثل Cursor و Claude Code و Codex ساخته شده، هم برای ایجنتهایی که مستقیم با مشتری کار میکنن، مثل ایجنتهای پشتیبانی. این سیستم الان تو پروداکشن خود اوبر اجرا میشه و مقالهی مربوط بهش هم برای کنفرانس MLSys 2026 پذیرفته شده.
ADR چهار بخش داره. بخش Observability رفتار ایجنت رو ثبت میکنه: قصد ایجنت، ابزارهایی که صدا میزنه و ردپای اجراش، اون هم روی بیشتر از ۷ ابزار کدنویسی هوش مصنوعی و روی هر سه سیستمعامل macOS و Linux و Windows. بخش Benchmark یا همون ADR-Bench بیشتر از ۳۰۰ تسک و ۱۳۳ سرور MCP داره و هر ۱۷ تکنیک شناختهشدهی حمله به ایجنتها رو پوشش میده.
بخش سوم Detection ـه که معماری دو لایه داره: یه لایهی اولیه با ریکال بالا که سریع همه چی رو غربال میکنه و یه لایهی عمیقتر و ایجنتیک که فقط سراغ نشستهای مشکوک میره. بخش چهارم یعنی Prevention که قراره جلوی اقدامهای ناامن رو قبل از اینکه ضرر بزنن بگیره، فعلاً تو نسخهی متنباز نیست و اوبر گفته بعداً منتشرش میکنه.
چیزی که تو مخزن قرار گرفته Sensor و ADR-Bench و Detector ـه؛ موتور آفلاین ADR Explorer که با ردتیمینگ قبل از استقرار بخش تشخیص رو سختجونتر میکنه، منتشر نشده. لایسنس پروژه Apache 2.0 ـه و دادههای بنچمارک هم کاملاً مصنوعیان — کردنشیالهای جعلی، محیطهای شبیهسازیشده و سناریوهای prompt injection که به گفتهی خود پروژه فقط برای تحقیقات امنیت دفاعی گذاشته شدن.
نکات کلیدی:
- ADR سیستم امنیتی اوبر برای ایجنتهای هوش مصنوعیه و روی پروداکشن اجرا میشه
- چهار بخش داره: رصد، بنچمارک، تشخیص و پیشگیری (پیشگیری هنوز متنباز نشده)
- ADR-Bench بیشتر از ۳۰۰ تسک، ۱۳۳ سرور MCP و ۱۷ تکنیک حمله رو پوشش میده
- تشخیص دو لایهست: غربال سریع، بعد بررسی عمیق نشستهای مشکوک
- لایسنس Apache 2.0 و دادههای بنچمارک مصنوعی، مخصوص تحقیقات دفاعی




