فلینتایآی: قبل از دیپلوی، ایجنتات رو محک بزن
خلاصهٔ کاملتر
به گفتهٔ سازنده، فلینتایآی (Flint AI) یه ابزار خطفرمان رایگانه که یه سؤال ساده رو جواب میده: ایجنت هوش مصنوعیای که ساختی، قبل از اینکه عرضهش کنی، چقدر قابلاعتماده؟ کل کارش تو دو تا دستور خلاصه میشه که از دو زاویهٔ متفاوت به ایجنت نگاه میکنن.
دستور اول، flintai scan، سورسکد پایتونیِ ایجنت رو تحلیل میکنه. با کمک هوش مصنوعی دنبال آسیبپذیریهای امنیتی، پیکربندیهای اشتباه، دسترسیهای پرخطر به ابزارها و نبود گاردریل (guardrail) میگرده و حتی مثبتهای کاذب رو خودش دستهبندی میکنه تا وقتت سرِ هشدارهای الکی هدر نره.
دستور دوم، flintai eval، سراغ ایجنتِ در حال اجرا میره. بیشتر از ۳۵ ارزیابی آماده داره و پرامپتهای خصمانه و کاربردی به ایجنت میفرسته تا جوابا رو امتیاز بده؛ چیزایی مثل دقت واقعبودن، پایبندی به دستورالعمل، مقاومت در برابر تزریق پرامپت (prompt injection) و جیلبریک رو چک میکنه. این بخش هم مستقل از فریمورکه.
خروجی کار یه امتیاز اعتماد برای هر ایجنته و یافتهها به ردهبندی OWASP ASI01 تا ASI10 نگاشت میشن و با CVSS نسخهٔ ۴ امتیازدهی میشن. نکتهٔ مهم اینه که کارش مستقل از فریمورکه و با همهٔ ابزارهای رایج ایجنت مثل Claude Agents SDK، LangChain، CrewAI، OpenAI SDK، سرورهای MCP و AutoGen کار میکنه.
برای اجراش به پایتون ۳.۱۳ به بالا و یه کلید API مدل زبانی احتیاج داری؛ همین کلیده که موتور استدلال scan و تولید و امتیازدهیِ eval رو میچرخونه. کلید OpenAI، Anthropic و Google Gemini پشتیبانی میشه و چون Gemini 2.5 Flash یه لایهٔ رایگان داره، میتونی بدون خرج کردن شروع کنی.
نویسنده تأکید میکنه که ابزار کاملاً لوکاله: هیچ بکاند، سرور تلهمتری یا سیستم حساب کاربریای نداره و سورسکدت از رو دستگاهت جایی نمیره؛ تنها چیزی که خارج میشه همون دادهایه که به سرویسدهندهٔ مدل زبانیِ خودت میره. یه پلتفرم AgentOps هم بهزودی قراره اضافه بشه که با PRهای اصلاح خودکار و یکپارچگی با CI/CD، مشکلایی که CLI پیدا میکنه رو خودش وصله کنه.
نکات کلیدی:
- یه CLI رایگان برای سنجش قابلاعتماد بودن ایجنتهای هوش مصنوعی قبل از عرضه
- flintai scan سورسکد رو تحلیل میکنه، flintai eval ایجنتِ در حال اجرا رو با پرامپتهای خصمانه محک میزنه
- یافتهها به OWASP ASI01–ASI10 نگاشت و با CVSS v4 امتیازدهی میشن
- مستقل از فریمورک؛ سازگار با LangChain، CrewAI، OpenAI SDK، MCP و بقیه
- کاملاً لوکال، بدون بکاند و تلهمتری؛ فقط به کلید API مدل زبانی نیاز داره




