آدریان: لایهٔ امنیتی رانتایم برای ایجنتهای هوش مصنوعی
خلاصهٔ کاملتر
آدریان یه پروژهٔ متنبازه که خودش رو «لایهٔ امنیت رانتایم» برای ایجنتهای هوش مصنوعی معرفی میکنه. برخلاف اکثر ابزارهای مانیتورینگ که فقط لاگ اکشنها (فراخوانی API، ابزارها، دیتابیس و…) رو نگاه میکنن، آدریان زنجیرهٔ استدلال ایجنت رو هم میخونه تا بفهمه ایجنت تو چه زمینهای و با چه هدفی داره یه کار رو انجام میده. سازندهها میگن ترکیب این دو تحلیل (رفتار و استدلال) دقیقاً همون چیزیه که یه پژوهش مشترک اوپنایآی و دیپمایند نشون داده نتیجهٔ بهتری میده، و آدریان اولین ابزاریه که این ایده رو به یه کنترل امنیتی واقعی و رایگان تبدیل کرده.
این ابزار میتونه پرامپت اینجکشن (مستقیم و غیرمستقیم)، مسمومسازی ابزار، نشت داده و اطلاعات محرمانه، و افزایش دسترسی یا اکشنهای خارج از حیطهٔ مجاز ایجنت رو تشخیص بده. تفاوتش با کلسیفایرهایی که فقط رو دیتاستهای حملههای شناختهشده آموزش دیدن اینه که آدریان یه درک کلی از «قرار بود این ایجنت چیکار کنه» نگه میداره و هر اکشن جدید رو با همون مقایسه میکنه؛ مثلاً اگه یه ایجنت فروشگاهی یهو شروع کنه به ریست کردن پسورد کاربرها، حتی اگه تو هیچ دیتاست آموزشی نبوده، آدریان میفهمه یه چیزی غیرعادیه.
نصب و استفادهش هم سادهست؛ برای ایجنتهای LangChain کافیه SDK پایتونش رو نصب کنی و دور کد اصلی یه init و shutdown بذاری:
import adrian
adrian.init(api_key="adr_live_...")
llm = ChatOpenAI(model="gpt-4o")
response = await llm.ainvoke("...")
adrian.shutdown()آدریان هم بهصورت مدیریتشده (دشبورد ابری) در دسترسه، هم میشه کاملاً روی سرور خودت و آفلاین (با یه مدل کوچیک محلی) اجراش کرد؛ برای Claude Code هم یه پلاگین اختصاصی داره که هر فراخوانی ابزار رو همون لحظه تو ترمینال بررسی میکنه.
نکات کلیدی:
- آدریان هم رفتار هم زنجیرهٔ استدلال ایجنت رو تحلیل میکنه، نه فقط لاگ اکشنها
- میتونه پرامپت اینجکشن، نشت داده و اکشنهای خارج از حیطه رو تشخیص بده
- برخلاف کلسیفایرهای مبتنی بر دیتاست، رفتار غیرعادی رو حتی بدون نمونهٔ قبلی میشناسه
- SDK پایتون و تایپاسکریپت داره و یه پلاگین اختصاصی برای Claude Code
- هم بهصورت ابری، هم کاملاً آفلاین و خوداستقرار قابل اجراست




