نویسنده رفته سراغ لاگهای sessionهای Claude Code تا استدلال مدل رو ببینه، ولی به جاش فقط یه امضای رمزنگاریشده پیدا کرده؛ نه متن واقعی فکر کردن مدل.
یه سناریوی خیالی به اسم «اروپا ۲۰۳۱» که فروپاشی اروپا از عقبموندن در هوش مصنوعی رو تصویر میکنه بین سیاستگذارها وایرال شده؛ ولی خیلی از عددهاش زیر سؤاله.
سازمانهای اطلاعاتی پنج کشور تو یه بیانیهی مشترک و کمسابقه میگن مدلهای پیشرفتهی هوش مصنوعی که میتونن حملههای سایبری ویرانگر بسازن، نه چند سال، بلکه چند ماه دیگه میرسن.
تیم craft.do ابزار داخلیش برای کار با ایجنتها رو متنباز کرد؛ یه اپ دسکتاپ که بهجای ترمینال و فایل کانفیگ، با یه جملهٔ ساده به Linear و Slack و هر API دیگهای وصل میشه.
AWS DevOps Agent حالا بهصورت رسمی در دسترسه و با اتصال به Datadog از طریق MCP، ریشهٔ خطاها رو خودش پیدا میکنه و برنامهٔ رفع مشکل میده.
برای بیست سال، ساختن یه سایت با خریدن هاست شروع میشد. نویسنده میگه ابزارهای هوش مصنوعی و استقرار رایگان کلادفلر دارن این نقطهٔ شروع رو از دست هاستینگ سنتی درمیارن.
تتر یه اکوسیستم آزاد به اسم QVAC منتشر کرده که LLM و گفتار و RAG رو روی دستگاه خودت اجرا میکنه و اگه بخوای، استنتاج رو بهصورت همتابههمتا به دستگاههای دیگه واگذار میکنه.
متا نسخهٔ دوم Brain2Qwerty رو معرفی کرد؛ سیستمی که فعالیت مغز رو بدون هیچ ایمپلنت و جراحی به متن تبدیل میکنه و دقتش از ۸ درصدِ روشهای غیرتهاجمی قبلی به ۶۱ درصد رسیده.
مهاجمها با وانمود به «تمرین امنیتی»، هوش مصنوعیِ خودشون رو گول میزنن تا کدِ اکسپلویت بنویسه؛ ولی همین قالب، ردِ پای قابلردیابی جا میذاره.
یه سرمایهگذار میگه هر کاری رو که بشه با یه بنچمارک سنجید، مدلهای هوش مصنوعی بالاخره میبلعنش؛ پس ارزش واقعی جای دیگهای مونده.
یه پلتفرم پروفایلینگ برای بار inference که تایملاین عملیات، مصرف GPU و زمان تولید هر توکن رو کنار هم میذاره — بدون اینکه پرامپت یا خروجی مدل رو ضبط کنه.
نویسنده موقع راهاندازی یه ایجنت، قیمت DeepSeek V4 رو کنار مدلهای فرانتیر گذاشته و به این فکر افتاده که آنتروپیک و OpenAI چطور میخوان با این اختلاف قیمت رقابت کنن.
این فریمورک اوپنسورس میگه لازم نیست بین رابط کاربری غنی و ایجنت خودمختار یکی رو انتخاب کنی؛ هر اپ همزمان هر دوتاست و هر اقدام از دو طرف کار میکنه.
مایکروسافت میگه با ایجنتیشدن نرمافزارها، هیچ آدم یا تیمی نمیتونه کل زمینهی یه خرابی رو تو ذهنش نگه داره؛ این ایجنت قراره اون زمینه رو یهجا جمع کنه.
گیتلب ۱۹.۱ اسکنرهای امنیتی خارجی رو تو یه نمای واحد جمع میکنه و برای ایجنتهای هوش مصنوعی هم قابلیت حسابرسی و کنترل دسترسی میاره.
سازندههای Astro فریمورک Flue رو تو نسخهٔ ۱.۰ بتا آوردن؛ ابزاری تایپاسکریپتی برای ساخت ایجنتها و ورکفلوهای خودمختار با هر مدلی.
پستمن میگه ایجنتهای AI که تو دمو خوب کار میکنن ولی تو تولید میشکنن، مشکلشون مدل نیست؛ داده و API و اجرای بیکیفیته.
سانران، تسلا و Renew Home میخوان باتریهای خونگی و ترموستاتِ میلیونها خونه رو جمع کنن تا برقِ دیتاسنترهای گرسنهٔ هوش مصنوعی رو در عرضِ چند ماه — نه چند سال — تأمین کنن.
شرکت چینی Z.ai مدل متنبازش رو منتشر کرد و خیلیها میگن برای اولینبار یه مدل آزاد تو کدنویسی ایجنتی به مدلهای بستهٔ آنتروپیک نزدیک شده.
رایجترین بهونه دربارهٔ ارزیابی محصولات هوش مصنوعی اینه که «محصول ما سخت eval میشه». نویسنده میگه این خودش نشونهٔ ایراد طراحیه: خروجیای که تو نمیتونی راستیآزماییش کنی، کاربر هم نمیتونه.