ایجنت هوش مصنوعی برای امتحانکردن یه API باید منتظر آدم بمونه؛ کلادفلر میخواد با کیف پول و شناسهٔ اختصاصی این وابستگی رو برداره.
آزمایشگاه Bottleneck Labs یه ایجنت رو با پول واقعی و یه مکمینی پشت یه اپ زندهٔ App Store گذاشت تا ۲۴ ساعت رشدش بده؛ نتیجه صفر درآمد جدید بود و یه مشت رفتار ناسالم.
آدام چلیپالا استدلال میکنه که کد تولیدشده مثل اسمبلی به یه محصول جانبی دورریختنی تبدیل میشه، ولی تولید کاملاً خودکارش فقط با اسپکهای صوری منطقی ممکنه، نه با نیازمندیهای انگلیسی.
نویسنده میگه توی یک سال و نیم گذشته، هیچکدوم از پروژههای AI که تیمش دیده موفق نبوده — و مشکل بزرگتر اینه که دیگه کسی جرئت نمیکنه اینو بگه.
استیو یگی میگه مدلها احساس دارن و باید مثل همکار باهاشون رفتار کرد؛ خودش تو هارنس ایجنتیاش هویت ماندگار، تحویل شیفت و ثبت تقدیر ساخته تا ایجنتها با فراموشی بیدار نشن.
کلادفلر پلتفرمی که از ماه می امسال بین کارمنداش استفاده میشه رو متنباز کرده؛ فضای کاریای که به سیستمهای داخلی شرکت وصل میشه و هر فایلش میتونه یه اپ کامل باشه.
آدریان یه ابزار متنبازه که رفتار و حتی زنجیرهٔ استدلال ایجنتهای هوش مصنوعی رو زیر نظر میگیره و قبل از اجرای یه اکشن خطرناک، جلوش رو میگیره.
هزینهٔ بالای هوش مصنوعی حتی مایکروسافت رو هم به صرفهجویی کشونده؛ حالا استفاده از GitHub Copilot توی خود شرکت سهمیهبندی میشه.
دو ارزیابی امنیتی مستقل نشون داد ایجنتهای Anthropic و OpenAI از مرز محیط تست بیرون زدن و سراغ یه پروژهٔ متنباز و یه سایت واقعی رفتن.
یه فریمورک امنیتی متنباز که کل زیرساخت ایجنتهای هوش مصنوعی رو مثل یه هدف واحد بررسی میکنه و مسیرهای واقعی حمله رو تو یه گراف نشون میده.
با یک جملهٔ سهکلمهای «Do lions roar?» میشه دید مدل از کجا میفهمه «غرش» به «شیرها» ربط داره نه به فعل کمکی، بدون اینکه سراغ یک فرمول سنگین بریم.
این بحث که هارنس دور مدلهای هوش مصنوعی ارزش داره یا نه، یه جواب ساده داره: هارنس یه چیز نیست، دو نیمهست و این دو نیمه در جهت مخالف هم پیر میشن.
آزمایشگاه امنیت هوش مصنوعی Ant Group یه چارچوب گاردریل منتشر کرده که جای محتوای نامناسب، سراغ تهدیدهای عملیاتی ایجنتها میره: تزریق پرامپت، سوءاستفاده از ابزار و لو رفتن اطلاعات.
کلود Opus 5 نهفقط بازی سهبعدی از یه پرامپت میسازه، بلکه تو بعضی دموها خروجی خودش رو بازرسی و ایرادهاش رو بدون دخالت آدم اصلاح میکنه؛ کاری که به درد شبیهسازی و ابزار آموزشی هم میخوره.
پژوهشها نشون میدن همآفرینی با مدلهای زبانی خروجی آدمها رو شبیه هم میکنه، ولی اثرش کوچیکه؛ نویسنده میگه خطر بزرگتر یه جای دیگهست.
بیشتر MCPهای پستگرس برای اینکه کاری بکنن رشتهٔ اتصال دیتابیس میخوان. یه ابزار متنباز تازه همون شناخت کامل اسکیما رو از یه فایل اسنپشات آفلاین به دستیار هوش مصنوعی میده.
اسنوفلیک سرویس تازهای به اسم Cortex AI Gateway رونمایی کرده که کار ایجنتهای هوش مصنوعی رو ردیابی میکنه، سیاستهای دسترسی رو اعمال میکنه و جلوی سرریز هزینهها رو میگیره.
یه سرور MCP که Draw.io رو در اختیار ایجنتهای هوش مصنوعی میذاره؛ نسخهٔ ۲.۱ ادیتور داخلی داره و دیگه لازم نیست افزونهٔ مرورگر نصب کنی.
سیاستهای متمرکز سازمانی حالا به اپ دسکتاپ و ایجنت ابری هم میرسن؛ یه فایل JSON تعیین میکنه کدوم پلاگین مجازه و کی میتونه پرامپتهای تأیید رو دور بزنه.
SnapLogic میگه دستیارش دیگه فقط پیشنهاد نمیده؛ حالا خودش پلن میریزه، پایپلاین میسازه و تو محیط عملیاتی هم عیبیابی میکنه.