یه مقالهٔ پژوهشی روشی به اسم SAO رو معرفی میکنه که با نمونهگیری تکrollout، آموزش ناهمگام عاملهای هوش مصنوعی رو پایدارتر میکنه و از GRPO جلو میزنه.
یان لوکان، از پیشگامهای هوش مصنوعی، میگه xAI ایلان ماسک عملاً شکست خورده و نمیتونه با OpenAI و Anthropic رقابت کنه، و هشدار میده کل صنعت سر هزینهها ممکنه بترکه.
Spotlight محصول تازهٔ Backplanes، سشنهای Claude Code و Codex رو بعد از پایان میخونه و بهت گزارش میده که ایجنت دقیقاً چی کار کرده و کجا باید حواست باشه.
دو تا مدل سازمانی برای پردازش انبوه اسناد، دو تا انتخاب متفاوت: Sol خیلی ارزونتر کار میکنه ولی Fable 5 روی اسناد شلوغ و طولانی دقیقتره.
چون SpaceX و Meta دارن ظرفیت پردازششون رو اجاره میدن، بعضیا فکر میکنن کمبود GPU تموم شده؛ این تحلیل میگه ماجرا برعکسه.
حالا که هوش مصنوعی بخش بزرگی از کد رو مینویسه، توسعهدهندهها گیر بقیهٔ فرایند افتادن. آیبیام با آپدیت جدید Bob سراغ هماهنگکردن کل چرخهٔ توسعه رفته.
OpenAI مدلهای GPT-5.6 رو با سه نسخهٔ Sol و Terra و Luna منتشر کرد؛ جمعبندی واکنشها میگه ارزون و کاربلده، ولی گزارشهای پاکشدن فایل کاربرها هم کم نیست.
خروجی Claude Code و Cursor معمولاً آماتور به نظر میرسه؛ این پروژه به جای دادن دیتای بیشتر، ۶۹ قانون طراحی رو به مدل یاد میده.
جمینای حالا پیشنهاد میده هر فایل سرگردون توی درایو رو کجا بذاری؛ تا خودت تأیید نکنی هم هیچی جابهجا نمیشه.
یه توصیه رایج میگه برای عاملهای AI باید آرگومانهای CLI رو با یه پیلود JSON جایگزین کنی؛ ولی آزمایش مایکروسافت خلافش رو نشون داد.
یه تیم بین ابزار کدنویسی و مدل، پراکسی گذاشت و دقیقاً دید هرکدوم چی میفرستن: برای گرفتن یه جواب یکخطی، یکی حدود ۳۳ هزار توکن خرج کرد و اون یکی حدود ۷ هزار.
متا معماری ذخیرهسازیِ BLOB خودشو از نو ساخت تا استوریج دیگه گلوگاهِ GPUها نباشه و پژوهشگرها بهجای ساعتها منتظرِ جابهجاییِ داده، تو چند دقیقه ایتریت کنن.
گوگل برای Sec-Gemini، مدل هوش مصنوعیِ آزمایشیِ متمرکز بر امنیت سایبریاش، مجموعهای از SDKها، یه کامپوننت وب و یه ابزار خط فرمان منتشر کرده.
یه مهندس پستهاگ پارسر SQL شرکت رو با چند نشست موازی Claude Code بازنویسی کرد و به کمک تست خودکار به یه نسخهٔ دستساز رسید که تو پروداکشن تا ۴۵۴ برابر سریعتره.
وقتی از Claude سؤالی میپرسی که جواب قطعی نداره، پاسخش یهسری ارزشو منعکس میکنه. Anthropic تو یه پژوهش تازه اندازه گرفته که این ارزشها بین مدلها و زبانهای مختلف چطور تغییر میکنن.
تو کنفرانس امسال بازارهای پیشبینی، همه حرف از هوش مصنوعیهایی بود که دارن با پیشبینی آینده پول درمیارن و از انسانها جلو میزنن.
گوگل LiteRT.js رو معرفی کرد؛ کتابخونهای که مدلهای .tflite رو با شتاب سختافزاری بومی مستقیم داخل مرورگر اجرا میکنه تا هم حریم خصوصی حفظ شه هم تأخیر و هزینهی سرور بیفته.
بایتدنس نسخهٔ تازهٔ مدل ویدیوسازش رو تو پکن معرفی کرد؛ کنترل بیشتر روی خروجی، ولی همون پروندهٔ باز کپیرایت که جلوی عرضهٔ نسخهٔ قبلی تو آمریکا رو گرفت.
WebKit یه سرور Model Context Protocol برای سافاری معرفی کرده که ایجنت کدنویسیت رو به یه پنجرهٔ سافاری وصل میکنه تا خودش ببینه کدت واقعاً چطور رندر میشه و مستقلتر دیباگ کنه.
یکی سریع و ساختارمند نقشه میده، اونیکی کندتر ولی صادقتر شکافها رو رو میکنه. انتخاب بین این دو مدل برای برنامهریزی و بازبینی کد یه تصمیم واقعیه.