Anthropic یه دروازهٔ خودمیزبان معرفی کرده که هویت، سیاست، رصد مصرف و سقف هزینهٔ Claude Code رو تو یه کانتینر واحد جمع میکنه؛ بدون اینکه ترافیک یا دادهٔ مصرف به Anthropic برگرده.
مایکروسافت دو مدل کلود رو روی ۱۵۰ تسک واقعی سنجید و به نتیجهای رسید که خیلیا رو غافلگیر میکنه: مدل جدیدتر و ارزونتر، گاهی چند برابر گرونتر و بیکیفیتتر درمیاد.
دو هفته بعد از تعلیق صادرات مدلهای Mythos و Fable ۵، یه استارتاپ ژاپنی و یه شرکت امنیتی چینی محصولاتی رو رونمایی کردن که خودشون رو جایگزین اونها معرفی میکنن.
نویسنده میگه موفقیتِ ایجنتهای هوش مصنوعی تو سازمانها بیشتر از انتخابِ جدیدترین مدل، به یه لایهی عملیاتیِ سالم و قابلمشاهده بستگی داره؛ لایهای که کمتر دیده میشه.
بهجای اینکه ایجنت از صندوق ایمیل آدمها استفاده کنه، محصول جدید Agent Accounts با یه فراخوان API براش یه صندوق و تقویم مستقل میسازه که مالکش نرمافزار شماست.
آزمایشگاه امنیتی Varonis یه ایجنت هوش مصنوعی ساخت و ترفندهای قدیمی فیشینگ رو روش تست کرد؛ نتیجه نشون داد یه ایمیل باورپذیر کافیه تا اطلاعات حساس لو بره.
Anthropic جزئیات محافظهای سایبری مدل Fable 5 رو منتشر کرد و یه چارچوب پیشنویس برای درجهبندی شدت جیلبریکها پیشنهاد داد تا صنعت و دولتها با یه زبون مشترک از خطر حرف بزنن.
یه بخش تازهٔ اینباکس با سه فیلتر تو اپ Gemini پیدا شده که ایمیلها رو از Gmail میکشه بیرون و یه فهرست کارِ ساختارمند برای کاربر میسازه.
یه مهندس طراح میگه ایجنتهای هوش مصنوعی ساختن هر چیزی رو راحت کردن، ولی همین راحتی میتونه کیفیت محصول رو فدای کمیت کنه.
پال باکاوس، سازندهی Impeccable، میگه ایجنتها میتونن طراحی رو بهتر کنن، ولی هیچوقت نباید جای قضاوت آدم رو بگیرن؛ او با «حالت خودکار» کاملاً مخالفه.
اوپنایآی به این نتیجه رسیده که بهجای یه مرورگر جدا، بهتره قابلیتهای مرور هوشمندش رو ببره سراغ جایی که کاربرا همین الان کار میکنن؛ حتی توی خود Chrome.
یه دروازهٔ API که با یه کلید و همون سینتکس OpenAI بهت دسترسی به بیش از ۷۰ مدل زبانی بزرگ میده، با تمرکز روی قیمت پایین و تأخیر کم.
همکاری مشترک Z Lab، Modal و تیم SGLang یه مدل drafter تازه معرفی کرده که با ترکیب دیفیوژن و تزریق KV، تولید توکن مدلهای زبانی رو خیلی سریعتر میکنه.
ایجنتهای کدنویس سریع کامیت میزنن ولی جواب CI دیر میرسه. ابزار رایگان جدید CircleCI اعتبارسنجی build و تست و lint رو تو یه microVM محلی و زیر یک دقیقه انجام میده.
وقتی ساختن ارزون میشه، بخش زیادی از چیزی که کرافت مینامیدیم فقط تولید بوده؛ نویسنده میگه همون ابزارها میتونن کرافت واقعی رو نگه دارن، به شرطی که استانداردهات رو بنویسی.
شرکت Z.ai مدل جدید GLM-5.2 رو منتشر کرده که تو خیلی از بنچمارکها به مدلهای بستهی ردهبالا نزدیک شده و بهنظر میرسه فعلاً بهترین مدل متنباز دنیاست.
بیشتر ابزارهای هوش مصنوعی طراحی، وکتور یا کامپوننت خودشون رو تحویل میدن؛ Forge میگه با کامپوننتهای واقعی دیزاینسیستم خودت کار میکنه و کد قابلعرضه بیرون میده.
انتروپیک مدلِ جدیدش Claude Sonnet 5 رو معرفی کرد؛ مدلی که تو کارهای ایجنتی نزدیک به Opus 4.8 عمل میکنه ولی خیلی ارزونتره.
بیرگیتا بوکلر از Thoughtworks مدلهای کوچیک رو روی مک خودش برای کدنویسی agentic تست کرده و میگه نتیجه یه سفر پر فراز و نشیب و گاهی گیجکننده بوده.
نویسنده میگه جنگِ هوش مصنوعی از رقابت بر سرِ هوشِ مدل به یه نبردِ چندلایه رو کلِ زیرساخت تبدیل شده؛ جایی که برنده کسیه که بیشترین لایهها رو یکپارچه کنه.