یه اپ منوبار برای مک که کارهای Claude Code، Cursor و بقیه ایجنتهای کدنویسی رو ثبت میکنه؛ از فرمانهای اجراشده تا فایلهای تغییرکرده، بدون اینکه چیزی از مک شما خارج بشه.
تیم exe بهجای اینکه یه آدم رو پای مانیتور دیپلوی بذاره، یه ایجنت هوش مصنوعی به اسم آتنا رو مسئول تصمیمگیری درباره ریلیزها کرده.
یه پروژهٔ متنباز که vault مارکدانیت رو مستقیم در اختیار ایجنتهای کدنویسی میذاره، بدون اینکه هر بار محتوا رو دستی بچسبونی تو پرامپت.
پروژهی متنباز Reasonix یک ایجنت کدنویسیه که با یک باینری Go روی ترمینال، دسکتاپ، مرورگر یا ویرایشگر کد اجرا میشه و روی هیچ مدل خاصی قفل نیست.
دن لو یه ماه یه ایجنت رو ول کرد تا موتور regex بنویسه؛ آخرش تو بنچمارک معروف rebar از Rust جلو زد، ولی روی دیتاست کنارگذاشتهشده ۱۰ برابر کندتر بود. مشکل فقط این یه پروژه نیست.
متیو ممت با کمک AI ظرف دو روز یه وایرفریم برای یه سازمان غیرانتفاعی ساخت، ولی چون طراح و مهندس قبلش ندیده بودنش، دو تا فیچر ساختگی داخلش موند و کل جلسه بههم خورد.
اسپیریت ایرلاینز امسال تعطیل شد و حالا تو حراج ورشکستگی، گوگل با ۱۰ میلیون دلار بخش دادههای سازمانیش رو برداشته؛ از میلیونها ایمیل تا ۳۰ میلیون خط کد.
کلود میتونه کارهای تکراری رو روی یه زمانبندی و توی فضای ابری اجرا کنه، ولی این وقتی جواب میده که از قبل فایلهای مرجع و Skill درست رو براش چیده باشی.
دادهی باکیفیت هر حوزه کمه و با بزرگتر شدن مدل ته میکشه؛ این مقاله میگه تکرار همون داده تا کجا کمک میکنه و کِی به ضرر مدل تموم میشه.
یه اپ دسکتاپ متنباز که به بیش از ۱۷ مدل و سرویس هوش مصنوعی وصل میشه و از راه دور هم قابل کنترله.
اندری کارپاتی یه روش ساده برای سازماندهی دانش شخصی با کمک LLM معرفی کرد و خیلیها از جمله یه روزنامهنگار باسابقه رفتن سراغ ساختنش؛ نتیجه بعد از یک ماه استفاده جالبه.
یه مقالهٔ جدید arXiv میگه موفقشدن عامل AI کافی نیست؛ اگه مسیر رسیدن به جواب از دسترسی غیرمجاز یا خرج بیحساب رد شده باشه، اون نتیجه قابلاتکا نیست.
یه بنچمارک تازه با ۷۰ بازی متنی، مدلها رو میندازه وسط بازیهایی که قانونهاشون معلوم نیست تا خودشون کشفشون کنن؛ آدمها همهشون رو بردن، مدلها تو سطح آخر گیر کردن.
با وصل کردن پلاگین تقویم گوگل میتونی به زبون ساده یه قانون بدی؛ مثلاً هر وقت بیشتر از دو ساعت جلسهٔ پشتسرهم داشتی، خودش نیمساعت استراحت بذاره.
استارتاپ اروپایی وایبکدینگ Lovable تو دور Series C چهارصد میلیون دلار گرفت و ارزشش رسید به ۱۳.۳ میلیارد دلار؛ کمتر از یک سال قبل این عدد ۶.۶ میلیارد بود.
دایناترِیس با خرید Arize میخواد رفتار مدلها و ایجنتهای هوش مصنوعی رو به دادههای زیرساخت وصل کنه تا وقتی چیزی خراب میشه، بشه علتش رو دنبال کرد.
دنیل میسلر، پژوهشگر امنیت، میگه اولین حملهٔ بزرگ به هوش مصنوعی میتونه یه کرم تزریق پرامپت باشه که از ایمیل به ایمیل دیگه پخش میشه.
گوگل به Workspace Studio یه مجموعه کنترل امنیتی سازمانی اضافه کرده تا ادمینها با خیال راحتتر اتوماسیونهای مبتنی بر ایجنت رو تو سازمانشون فعال کنن، از هویت مجزای فلوها تا DLP.
گزارش تازهٔ SOCRadar میگه بیشتر اون ۲۵۰۰ سازمان قربانی، چند روز قبل از انتشار پکیجهای آلوده و از مسیر یه اسکنر امنیتی بالادستی لو رفته بودن.
با test-time training مدل حین جوابدادن به پرامپت شما وزنهاش رو عوض میکنه؛ حافظه ثابت میمونه، ولی ارائهدهنده باید برای هر کاربر یه نسخهی جدا نگه داره.