مدل ۲۷ میلیاردی تازهی Qwen روی لپتاپ کد مینویسه و عکس میفهمه، ولی حالت استدلال پیشفرضش انقدر سنگینه که برای کشیدن یه دایره هم دقیقهها فکر میکنه.
ایجنتی که با Strands ساختی و روی سرور خودت یا GCP اجرا میشه، با یه پکیج و چند متغیر محیطی تلهمتریش رو به همون داشبورد AWS میفرسته.
یه مهندس میگه استانداردهایی که شرکتهای AI جا انداختن — چند سشن چت، انتخاب مدل، اتصال MCP — بار تصمیمگیری رو میندازن گردن کاربر و جلوی فراگیرشدن ایجنت تو سازمان رو میگیرن.
ZAI میگه GLM-5.3 بدون تغییر معماری یا تعداد پارامتر، فقط با آموزش تکمیلی از ۷۵ درصد به ۹۱٫۲۵ درصد رسیده؛ اون هم روی بنچمارکی که همه با یه پرامپت سنجیده میشن.
طبق یادداشت SemiAnalysis، گوگل برای یکی از TPUهای نسل دهمش با AMD کار میکنه؛ هدف احتمالی، چسبوندن هستهٔ CPU به خود پکیج شتابدهنده برای بارهای reinforcement learning ـه.
نسخهٔ جدید Model Context Protocol نشست پروتکلی رو برداشته و بهجاش سرور باید یه شناسه بده به مدل تا خودش بین فراخوانیها جابهجاش کنه.
Z.ai مدل GLM-5.3 رو معرفی کرد؛ با حدود ۷۵۰ میلیارد پارامتر به صدر بنچمارکهای کدنویسی ایجنتیک رسیده. نیتن لمبرت میگه راز کار پستترینینگ و سرعت انتشاره، نه کپیبرداری از مدلهای آمریکایی.
xAI مدل جدیدش رو با ۲ دلار ورودی و ۶ دلار خروجی بهازای هر میلیون توکن عرضه کرد؛ تو یه تست عملی، کاری که روی Claude Opus 5 حدود ۲ دلار خرج برداشت، اینجا حدود ۳۸ سنت تموم شد.
xAI مدل جدیدشو با یه دور آموزش تکمیلی روی همون پایهٔ ۴.۵ ساخته، ولی نتیجهش تو چند بنچمارک مهم چسبیده به GPT-5.6 و Claude Opus 5 — با هزینهٔ خیلی کمتر برای هر تسک.
از 16 آگوست 2026 دیپسیک صورتحساب API رو بر اساس ساعت حساب میکنه؛ نرخ ساعتهای غیراوج نصف اوجه و دو مدل V4 با کانتکست یک میلیون توکنی هم روی همین جدول نشستن.
سیسکو فصل چهارم مالی ۲۰۲۶ رو بالاتر از سقف پیشبینی خودش بست و میگه یه سوپرسیکل شبکه راه افتاده؛ سفارشهای هوش مصنوعی هم به ۹.۳ میلیارد دلار رسید.
یه مقالهٔ arXiv میگه اگه حالت پنهان لایهٔ آخر رو به قدم بعدی برگردونی، مدل ۱ میلیاردی به کیفیتی میرسه که معمولاً ۱.۵ برابر داده میخواد.
هاگینگفیس دادههای هفت ماه اول ۲۰۲۶ رو منتشر کرده: سقف اندازهٔ مدلهای چینی از آمریکاییها بالاتر رفته، ولی دانلودها هنوز سراغ مدلهای کوچیک و قدیمی میره.
Antigravity حالا اجازه میده با یه فایل Markdown ایجنت تخصصی بسازی؛ ایجنتی که هم میشه مستقیم باهاش کار کرد، هم ایجنت اصلی بهعنوان زیرایجنت صداش میزنه.
A10 Networks یه دروازهٔ متمرکز برای کل ترافیک AI سازمان عرضه کرده که هزینهٔ هر درخواست رو لحظهای نشون میده و کار ساده رو به مدل ارزونتر میسپاره.
بلومبرگ میگه Stripe سر خرید OpenRouter به توافق رسیده؛ استارتاپی که چند ماه پیش با ارزش ۱.۳ میلیارد دلار سرمایه گرفته بود و حالا بالای ۷ میلیارد قیمت خورده.
یه تست عملی روی دستخط، معادلات فیزیک، فاکتور چاپی و روزنامهٔ عربی نشون میده دقت این مدل بینایی کوچیک به زبان و نوع سند بستگی داره.
مدل متنبهموزیک MiniMaxAI آهنگ کامل با وکال تا پنج دقیقه میسازه و لوکال هم بالا میاد؛ فقط تو تستها بیرون از پاپ انگلیسی خروجیش حسابی افت کرده.
زوی موشوویتز پادکست دورکش پاتل با رایان گرینبلت رو نکتهبهنکته کالبدشکافی کرده؛ بحث سر اینه که هوش مصنوعی کی میتونه تحقیقات خودش رو خودکار کنه.
وزنهای DeepSeek V4 Pro با لایسنس MIT بیرون اومده و دستور اجراش روی vLLM و SGLang هم مستند شده؛ فقط یه نود چند GPUیی میخواد.