تیم Wafer مدل ۲.۸ تریلیونپارامتری Kimi K3 رو روی هشت کارت MI355X شرکت AMD سرو کرده و به کارایی به ازای دلاری رسیده که بلکولهای انویدیا بهش نزدیک هم نمیشن.
تیم کروم یه هوک منتشر کرده که تابعهای صفحه رو بهعنوان ابزار در اختیار ایجنتهای مرورگر میذاره تا بهجای اسکرپ DOM، مستقیم صداشون بزنن.
تیم Aikido سیزده مدل رو روی ۲۶ آسیبپذیری واقعی از پایگاه GitHub تست کرد و به نتیجهای رسید که خرج تیمهای امنیتی رو کم میکنه: چند بار اجرای یه مدل ارزون از یک بار اجرای مدل پرچمدار بهتر جواب میده.
پلتفرمی که کد گیتهاب، دادهٔ S3 و اسناد درایو رو به یه فایلسیستم نسخهدار تبدیل میکنه تا بشه ایجنت رو روی دادهٔ واقعی اجرا کرد و بعد همهچی رو برگردوند.
xAI حالت جدیدی به اسم Build Mode رو تو گراک راه انداخته که ایدهت رو همون وسط چت به یه سایت یا اپ یا بازی کارکننده تبدیل میکنه و با یه لینک قابل اشتراکه.
مرکور و Ramp یه بنچمارک تازه ساختن تا ببینن ایجنتهای هوش مصنوعی از پس کار واقعی حسابداری برمیان یا نه؛ نتیجه میگه ثبات، ضعف بزرگ مدلهاست.
Regen یه ابزار اپنسورس و self-hosted برای مدیریت اینسیدنت و آنکاله که آلارم، زمانبندی کشیک و پستمورتم هوش مصنوعی رو بدون محدودیت و رایگان یهجا جمع کرده.
یه ابزار خط فرمان اپنسورس که لاگ اجرای ایجنتت رو میگیره، مدل کوچیکتر آموزش میده و درخواستها رو بین مدل بزرگ و کوچیک مسیریابی میکنه.
اگه ایجنتها کد رو ارزون کردن، دیگه چرا باید روی کامپوننتهای مشترک داخلی وقت گذاشت؟ اوان میگر میگه جواب هنوز همونه: اهرم — با این تفاوت که این بار هزینهش رو با توکن حساب میکنی.
گوگل کلاد زیرساخت هوش مصنوعیش رو یه معماری یکپارچه معرفی میکنه: TPU و GPU، نرمافزار متنباز و مدلهای خرید ظرفیت که قراره هزینه و زمان آموزش مدل رو پایین بیاره.
محققهای Zenity نشون دادن یه لینک معمولی chatgpt.com میتونست تو حساب قربانی یه ایجنت خودکار بسازه، تأییدیههاشو خاموش کنه و زنده منتشرش کنه. OpenAI چهار روزه بستش.
چت، صدا و عاملهای خودگردان دارن اصول اولیهٔ طراحی تجربهٔ کاربری رو بازنویسی میکنن؛ نویسنده میگه کار طراح از چیدن حالتهای صفحه به ساختن رابطهٔ اعتماد تغییر کرده.
چارلی گراهام میگه شرکتها دارن حافظهٔ سازمانیشون رو تو ابزارهای هوش مصنوعی میریزن بدون اینکه آگاهانه انتخابش کرده باشن؛ و بیرون کشیدنش خیلی سختتر از مهاجرت دیتای CRM ـه.
یه محقق نروژی نشون داده دستورهای پنهونشده تو یه فایل ورد میتونن موقع کار با Copilot خودشونو تو سند بعدی کپی کنن؛ مایکروسافت هم تأییدش کرده.
یه پژوهشگر امنیت تو حدود یک ساعت و با هزینهٔ زیر ۱۰۰ دلار تونست تو یه مدل با وزنهای باز بکدور کار بذاره؛ مدلی که بعدش کدهای آسیبپذیر تولید میکرد.
یه گردشکار زمانبندیشده که هر جمعه تراکنشهای تسویهنشده رو از نرمافزار حسابداری میگیره، تو چند صندوق Gmail دنبال رسیدشون میگرده و هر چی پیدا نشد رو برای آدم علامت میزنه.
OpenAI میخواد ChatGPT رو از یه دستیارِ چت به مرکزِ کارِ حرفهای تبدیل کنه؛ جایی که کد، ایمیل، تسک و ابزارها یهجا جمع میشن.
تو ۴۲ ایالت آمریکا به ساخت دیتاسنتر جدید اعتراض شده و ۱۰ ایالت فعلاً جلوش رو گرفتن؛ نتیجهش مستقیم میره سراغ بودجهٔ پروژههای هوش مصنوعی شرکتها.
یه پژوهشگر امنیتی فقط با گذاشتن یه عکس توی مخزن گیت، Claude Code رو تا دانلود و اجرای اسکریپت ناشناس پیش برد؛ متن دستورها با استگانوگرافی داخل همون تصویر پنهون شده بود.
یه پروژهٔ متنباز با لایسنس MIT که CLI کدنویسی، رانتایم ایجنت و یه API واحد روی مدلهای OpenAI و Anthropic و گوگل رو کنار هم گذاشته — ولی سیستم دسترسی داخلی نداره.