نتلیفای با پارتنرشیپ OpenRouter مدلهای بیشتری به Agent Runners اضافه کرد، بعد یه پرامپت ثابت — سایت یه کافهٔ محلی — رو به ۱۱ مدل داد تا ببینه هرکدوم چی میسازه و چقدر اعتبار میسوزونه.
Raunak Kathuria، معاون مهندسی Deriv، میگه حالا که نوشتن کد ارزون شده گلوگاه واقعی مشخصکردن نیت محصوله؛ پیشنهادش اینه spec نسخهدار بشه منبع حقیقت و کد فقط یکی از خروجیهاش.
کلر وو تو یه ترد کوتاه میگه دو چیز جلوی پیشرفت AI تو شرکتها رو میگیره و هیچکدوم ربطی به کیفیت مدلها یا ابزارها نداره.
مستندات فورمن نشون میده یه ایجنت واقعی چطور چیده میشه: اسم ابزارها از روی فایلسیستم خونده میشه و هر زیرایجنت تو یه نشست تازه و بدون هیچ ارثی از ریشه اجرا میشه.
اوپنایآی یه تایر تازه و فوقسریع برای API خودش رونمایی کرده که GPT-5.6 Sol رو با کمک تراشههای Cerebras تا ۱۴ برابر سریعتر اجرا میکنه.
قیمت مدل تازهٔ دیپسیک دهها برابر زیر رقبای فرانتیره، ولی تو چند بنچمارک عاملی حتی بالاتر از همونها وایستاده؛ ضعفش یه جای دیگهست.
تیم Claude Code میگه با هر مدل جدید بخش بزرگی از سیستمپرامپتش رو حذف میکنه؛ چون دستورهای ریزی که برای مدل ضعیفتر نوشته شده بودن، حالا جلوی قضاوت خود مدل رو میگیرن.
تو استکهای تولیدی سازمانی بهطور میانگین ۱۴ مدل همزمان کنار هم کار میکنن؛ نویسنده میگه مهارت اصلی محصول دیگه انتخاب مدل نیست، چیدن اونها تو یه workflow قابلعرضهست.
الکس دنکو تو یادداشت جدیدش با کمک فلسفهی فرانسوی توضیح میده چرا انگ «۱۰۰٪ هوش مصنوعی» اینقدر جدی گرفته میشه، حتی از طرف طرفدارای خودِ هوش مصنوعی.
طبق صورتجلسهای درزشده از یه نشست چهارساعته، لیانگ ونفنگ که حالا از آلتمن و آمودی هم ثروتمندتره، داره کل شرطشو رو رسیدن به هوش عمومی مصنوعی میبنده، نه پول درآوردن از محصولای امروزی.
X کد اصلی الگوریتم رتبهبندی «For You» رو رو گیتهاب گذاشته و یه ابزار تازه هم اضافه کرده که باهاش میتونی بفهمی پستهات محدود شدن (شادوبن) یا نه.
علیبابا مدل Qwen3.8-2.4T-A95B رو با ۲.۴ تریلیون پارامتر متنباز کرده؛ رو چند تا آزمون کدنویسی از Opus 4.8 و GPT-5.6 Sol جلو زده، هرچند تو کارهای عمومیتر هنوز از Fable 5 عقبه.
نسخهٔ کامل V4 Pro بیسروصدا روی API اومد و تو بنچمارکهای ترمینال و اتوماسیون تا نوک جدول بالا رفت — با قیمتی که کسری از رقبای همردهشه.
دیپسیک یه فریمورک کدنویسی ایجنتی داده بیرون که ابزار و مدل و حتی ایجنتهای رقیب مثل Codex توش پلاگینان؛ تو یه تست واقعی هم ۲۰ میلیون توکن سوزوند.
قانونهای تازهٔ ایالتی آمریکا چتباتهای همدم رو موظف کردن مرتب بگن انسان نیستن. یه طراح محصول میگه این هشدارها خیلی زود به نویز پسزمینه تبدیل میشن.
دیپسیک یه بستر متنباز برای ساختن agent منتشر کرده که توش مدل، ابزار، سندباکس و رابط کاربری همه پلاگینان و با یه فایل کانفیگ عوض میشن.
چلسی فین میگه رباتها برخلاف چتباتها اجازهٔ اشتباه ندارن؛ راه رسیدن به اتکاپذیری بالای ۹۰ درصد از یادگیری تقویتی میگذره، ولی نه با روشهای مدلهای زبانی.
یه گفتوگوی کمسروصدا بین طراحهای باتجربه در جریانه: خیلیهاشون دارن به بازنشستگی زودهنگام فکر میکنن. Creative Boom سراغ چندتاشون رفته تا ببینه پشت این موج چی میگذره.
سازندههای ادیتور Zed یه اپلیکیشن تازه معرفی کردن که بهجای ادیتور، خودِ گفتگو با ایجنت رو مرکز کار میذاره و کل تیم همزمان توش کد و مکالمه رو میبینن.
قراره توی متن و تصویری که Claude تولید میکنه یه نشان نامرئی جاسازی بشه تا منشأ محتوا قابل تشخیص باشه؛ چیزی که قانون هوش مصنوعی اروپا از سازندهها خواسته.