دو هفته بعد از ممنوعیت صادرات مدلهای امنیتی Anthropic، یه شرکت چینی و یه استارتاپ ژاپنی مدل رقیب رونمایی کردن؛ یکیشون آشکارا روی «بدون ریسک کنترل صادرات» تبلیغ میکنه.
اتلسین فرمت DESIGN.md رو هم تو ابزارهای vibe coding و هم تو کدبیس واقعی تست کرده؛ نتیجه: برای پروتوتایپ عالیه، ولی تو پروداکشن حدود ۹۲٪ توکن بیشتر مصرف میکنه.
کتابخونهی جدید TanStack هر سرور MCP رو به یه آرایهی ساده از ابزار تبدیل میکنه تا هر مدلی و هر فریمورکی بدون اینکه بفهمه MCP وسط بوده، باهاش کار کنه.
لوناگراف یه بومِ طراحیه که بهجای فایلِ دیزاین، مستقیم کدِ واقعیِ HTML، CSS و ریاکت میسازه، با Claude Code کار میکنه و الان نسخهٔ بتای عمومیش اومده.
لیکویید ایآی کوچکترین مدلش رو منتشر کرد: ۲۳۰ میلیون پارامتر که روی موبایل و حتی رزبریپای اجرا میشه و تو ابزارفراخوانی از مدلهای دوبرابریاش جلو میزنه.
OpenAI مجموعهای از ابزارهای امنیتی رو معرفی کرد که تمرکزشون از فقط پیداکردن آسیبپذیری به ساختن و اعمال وصلهها منتقل شده، از جمله یه مدل امنیتی جدید و یه برنامهٔ متنباز برای وصلهکردن پروژهها.
گزارش شده اوپنایآی سر اجارهٔ یه کمپ دیتاسنتر عظیم تو اوهایو مذاکرهٔ جدی داره؛ قراردادی که میتونه نزدیک ۵۰۰ میلیارد دلار آب بخوره و Nvidia پشتش باشه.
جالبترین ابزارهای هوش مصنوعی بصری دیگه خودِ تصویر نهایی رو نمیسازن؛ سورسِ پشتش رو تولید میکنن تا بشه دائم ویرایش، تست و بهترش کرد.
نویسنده میگه یاد دادنِ ابزارهای هوش مصنوعی به تیمها راحته؛ سختش اینه که سازمان بهشون فضا و اجازهی آزمایش بده، وگرنه فقط feature بیشتری تولید میشه.
اریک بیلی، طراح دسترسیپذیری، از احساسات دوگانهش دربارهٔ کدنویسی با هوش مصنوعی مینویسه؛ جایی که مجبوره مثل بقیه با LLM کد بزنه تا تجربهای رو برای کاربرهای معلول بهتر کنه.
هر جوابِ یه مدلِ زبانی از دو فازِ prefill و decode ساخته میشه که روی GPU گلوگاهِ کاملاً متفاوتی دارن — و کلِ مهندسیِ inference دورِ همین شکاف میچرخه.
همه یهو میگن بهجای پرامپت زدن باید حلقه بنویسی. این نوشته میگه ایده درسته ولی شعارش گمراهکنندهست و با یه معادلهی ساده نشون میده کِی ساختن حلقه واقعاً میارزه.
گزارش تازهٔ Harness میگه مدیرهای مهندسی از جهش بهرهوری با ابزارهای AI حرف میزنن، ولی خودشون هم قبول دارن معیارهاشون بدهی فنی و زمان اعتبارسنجی و فرسودگی رو اصلاً نمیبینه.
چند روز بعد از بزرگترین عرضهٔ اولیهٔ تاریخ، اسپیسایکس استارتاپ کدنویسی هوش مصنوعی Cursor رو با یه معاملهٔ ۶۰ میلیارد دلاری سهامی میخره تا بخش هوش مصنوعیش به رقبا برسه.
Sakana AI مدلی معرفی کرده که خودش یه LLMه ولی پشت صحنه مدلهای مختلف رو صدا میزنه و هماهنگ میکنه؛ شرکت میگه نسخهٔ Ultraش همتراز مدلهای پیشروئه.
کلادفلر قابلیتی آورده که ایجنتهای هوش مصنوعی بدون ثبتنام و لاگین مستقیم کدشون رو روی Workers دیپلوی کنن؛ اکانت موقت ۶۰ دقیقه زنده میمونه و بعد میتونی برای همیشه مال خودت کنی.
انویدیا و آمازون سه لایهٔ زیرساخت هوش مصنوعی رو با هم بهروز کردن: از GPUهای جدید Blackwell تا جستوجوی برداری روی GPU که حالا پیشفرض شده.
یه ابزار خطفرمان به اسم ax-audit در چند ثانیه میگه سایتت چقدر برای ایجنتها و مدلهای هوش مصنوعی آمادهست و کجاها باید درستش کنی.
گرپتایل ابزاری به اسم TREX ساخته که موقع بازبینی pull request فقط کد رو نمیخونه، بلکه واقعاً اجراش میکنه و با اسکرینشات و لاگ و ویدیو نشون میده کجا خراب شده.
اسنوفلیک از استاندارد باز ARD پشتیبانی میکنه؛ پروتکلی که کمک میکنه ایجنتهای هوش مصنوعی یه سازمان بهراحتی پیدا و فراخوانی بشن.