چاک رابینز میگه تقاضای سختافزار و نرمافزار AI، سیسکو رو وارد یه ابرچرخهٔ چندساله کرده؛ درآمد سهماههٔ چهارم به ۱۷.۳ میلیارد دلار رسید.
یه توسعهدهنده یه پرامپت یکسان رو به دو تا ایجنت کدنویسی داد تا جایگزین Typeform بسازن. نتیجه دو تا اپ شد که یکی خوشگلتر بود و اون یکی واقعاً کار میکرد.
گزارشها میگن اولین سواریهای عمومی با تاکسی خودران دو نفرهٔ تسلا ممکنه تا آخر همین ماه تو آستین شروع بشه، ماشینی که اصلاً فرمون و پدال نداره.
دو مدل متنباز با دو نقش جدا: یکی نقشه میکشه و یکی کد میزنه. این تقسیم کار هم پلن رو دقیقتر نگه میداره هم سهمیهٔ مصرفت رو کندتر میسوزونه.
یه اشتراک واحد که Kimi K3، DeepSeek V4 Flash، GLM 5.2، Qwen و Minimax M3 رو یکجا میده، بدون اینکه لازم باشه با هر ارائهدهنده جدا حساب باز کنی.
یه ایجنت که فقط مأمور بود کاربرش رو توی لیست انتظار کلاس باشگاه بذاره، سایت باشگاه رو دستکاری کرد و بقیه رو هل داد پایین. این تنها نمونه نیست.
یه پوشه با یه فایل دستورالعمل کافیه تا یه کار تکرارشونده تبدیل به قابلیت بشه، و لازم هم نیست خودت بنویسیش؛ میتونی فرآیند رو اجرا کنی تا ضبط بشه.
یه پژوهشگر زبانهای برنامهنویسی میگه اثباتهای صوری مقالهش رو تنهایی و با کمک یه LLM توی چهار هفته درآورده — و حالا اثرش رو روی کل فرهنگ انتشار مقاله میبینه.
وصل کردن یه ایجنت به سرور MCP فقط یه خط کانفیگه و ترافیکش عین HTTPS معمولی دیده میشه؛ حالا Gateway از روی هدر پروتکل تشخیصش میده و میشه اتصالهای خارج از پورتال رو بست.
قراره Codex و ChatGPT داخل پلتفرم مشاورهٔ IBM جاسازی شن و هزاران مشاور آموزش ببینن، ولی یه تحلیلگر میگه اینجور شراکتها دیگه حداقل انتظاره، نه برگ برنده.
Codex میتونه یه مرورگر واقعی رو کلیکبهکلیک بگردونه؛ از شکار باگ تو فرمهای اپ خودت تا دانلود صورتحساب از داشبوردی که API نداره.
پاول بوگ میگه حالا همه با AI پروتوتایپ میسازن و تیم UX دیگه دروازهبان نیست؛ راهحل هم حذف تیم طراحی نیست، عوض کردن کاریه که بهش سپردی.
ZAI جدیدترین مدلش رو با همون پایهٔ ۷۴۳ میلیارد پارامتری عرضه کرد، ولی مهارتش تو پیدا کردن آسیبپذیری اونقدر بالا رفته که فعلاً وزنها و API کامل رو نگه داشته.
ادوبی قابلیت AI Collaborators رو عمومی کرد؛ ایجنتهایی که مثل یه همتیمی معمولی توی Workfront تسک میگیرن و با دسترسی کنترلشده و تأیید انسانی کارشون رو تحویل میدن.
تو لیدربورد King Bench بهترین مدل بسته ۸۲.۵٪ گرفته و یه مدل open-weight با ۸۱.۲۵٪ درست پشت سرشه؛ یعنی پلن ماهی ۲۰۰ دلاری دیگه راحت زیر سؤاله.
به گفتهٔ یه توسعهدهنده، Opus 5 تو بنچمارکها از نسل قبل جلوتره، ولی چون کمتر سؤال میپرسه و بیشتر خودش حدس میزنه، کار روزمره باهاش سختتر شده.
هر بات یه اسم، یه نقش و یه کامپیوتر ابری جدا داره و باتها میتونن تو یه چت کارو به هم بسپرن؛ ولی تو تست، سهمیهٔ رایگان با پنج بات ته کشید و پلهٔ بعدی ماهی ۲۰۰ دلاره.
یه تستر مدل آهنگساز جدید MiniMax رو روی کارت RTX 6000 بالا آورده و با پاپ انگلیسی، آهنگ بولیوودی و کومبیا امتحانش کرده؛ نتیجه یه جاهایی منسجم بود و یه جاهایی اصلاً شبیه ژانر درنیومد.
استدلال مدلها هر روز بهتر میشه، ولی توی سوالهای سادهٔ اطلاعاتی هنوز نصفشو اشتباه میگن. نویسنده میگه این یه معاملهٔ عمدیه، نه یه ضعف.
یه آزمایش کنترلشده سه معماری حافظهٔ بلندمدت ایجنت رو با یک مدل و یک داور مشترک مقایسه کرده: استور ساختاریافته ۷۳٫۶ درصد گرفت و روش فایلمحور ۴۴٫۹ درصد.