اپل این دور آپدیت امنیتی رو خارج از روال همیشگی و زودتر منتشر کرد، چون چهار تا از باگهای WebKit رو ابزارهای هوش مصنوعی مثل Claude و Codex پیدا کرده بودن.
گوگل اسم ابزار تحقیقش رو عوض کرد و بهش یه کامپیوتر ابری امن داد تا بتونه روی منابع خودت کد بنویسه و تحلیل داده انجام بده.
یه مهندس مسئلهٔ بهینهسازی قدیمی خودشو داد دست Fable 5 و GPT-5.6 Sol تا ببینه حالت goal واقعاً کمک میکنه یا فقط به بد تصمیمها وقت بیشتری میده.
این دیگه یه fetch ساده نیست؛ یه نشست مرورگر واقعیه که صفحه رو کامل رندر میکنه، اسکرینشات میگیره و میتونه روی همون تصویر به اجزا اشاره کنه.
سنجش توانایی ایجنتهای هوش مصنوعی میتونه هزاران دلار خرج بذاره؛ این مقاله میگه با یه مشت تست ارزون هم میشه نتیجه رو با دقت بالا حدس زد.
تو یه مطالعهٔ ششماهه، ۸۴ درصد مهندسها گفتن هوش مصنوعی بهرهوریشون رو بالا برده. همزمان گروهی که تجربهشون بدتر شده بود تقریباً دو برابر شد.
گزارشها میگن کرسر داره ایجنتی میسازه که به ایمیل جواب بده و اسپردشیت مرتب کنه؛ اولین محصول این شرکت که مخاطبش برنامهنویسها نیستن.
تو بیلدهای اخیر جمینای، دکمهٔ Live تو نسخهٔ وب پیدا شده و ردپای اسکیلها هم از Spark به چتهای معمولی رسیده. هنوز هیچکدوم رسمی اعلام نشدن.
گزارش SACR میگه امنیت ایمیل تو ۲۰۲۶ رو باید یه مسئلهٔ گراف هویت با شواهد قابلممیزی دید، نه فیلتر محتوا با یه نرخ تشخیص روی بروشور.
گودفایر میگه پلتفرمش یه شبه J-space رو روی GLM-5.2 بازتولید کرده و تو دو روز روشی رو پیاده کرده که توهم Qwen3-8B رو ۳۷ درصد کم میکنه.
چهل صفحه دادخواست اپل علیه OpenAI رو که بخونی میبینی پرونده در عمل روی دو نفر بنا شده، ولی چیزی که میتونه گرون تموم بشه مرحلهٔ کشف مدارکه.
بیست سال نیت کاربر رو از روی کلیک حدس زدیم؛ حالا کاربر با زبان طبیعی مستقیم میگه چی میخواد و تقریباً هیچ تیمی این داده رو کنار هم نمیذاره.
الکس ترنر، پژوهشگر سابق گوگل دیپمایند، روایت میکنه چطور چند ماه تلاش کرد جلوی امضای یه قرارداد نظامی بیقیدوشرط رو بگیره و آخرش خودش رفت.
مدل باز Moonshot تو SWE-bench همردهٔ مدلهای بستهٔ پیشرو ظاهر شده، با قیمتی حدود پنج تا شش برابر کمتر. ولی تو فراخوانی ابزار هنوز عقبتره.
یه توسعهدهنده مدل متنباز Kimi K3 رو کنار Claude روی کار روزمرهش اجرا کرده و میگه عملاً فرقی حس نکرده — ولی صورتحسابها اصلاً شبیه هم نبودن.
یه ابزار رایگان از Mitiga Labs که فایلهای اسکیل و کانفیگ ایجنتهای هوش مصنوعی رو قبل از اجرا برای حملاتی مثل prompt injection اسکن میکنه و نمرهی خطر میده.
لنگچین ابزارش رو از مستندسازی کدبیس فراتر برده: حالا از جیمیل، نوشن، گیت و وب یه ویکی محلی میسازه که ایجنتها ازش بهعنوان حافظه استفاده میکنن.
کارلوس پرنت میگه طراحهای محصول سالهاست ورکشاپ و فریمورک رو جای طراحی جا زدن، و هوش مصنوعی نیومده جاشون رو بگیره؛ اومده نشون بده خیلیهاشون خیلی وقته دیگه طراحی نمیکنن.
نسخهٔ دسکتاپ Claude Code یه پنل iOS Simulator گرفته که اپ در حال ساخت رو اجرا میکنه، زنده میبینه و باهاش کار میکنه تا پروژه جمع بشه.
Anthropic قبول کرد که پاسخهای مدلش رو مخفیانه خراب میکرده تا جلوی distillation رو بگیره؛ حالا میگه این کارو شفاف میکنه حتی به قیمت ردکردن سوالهای بیشتر.