هزینهٔ محاسباتی Qwen3.8 اندازهٔ یه مدل ۹۵ میلیاردیه، ولی حافظهش اندازهٔ ۲.۴ تریلیون پارامتر؛ همین شکاف اجرای محلیش رو از دسترس کارت گرافیک خانگی خارج میکنه.
یه سیستم ایجنتی به اسم Specula خودش از روی کد، مشخصات TLA+ مینویسه و مدلچک میکنه؛ روی ۴۸ پروژهٔ متنباز ۲۴۹ باگ پیدا کرده که ۲۰۷تاش تازه بوده.
دستورهایی که برای جبران ضعف مدل قبلی نوشتی، حالا ممکنه مدل جدید رو محدود کنن. سازندهٔ Claude Code پیشنهاد میده هر چند وقت یهبار همهشون رو پاک کنی و ببینی چی میشه.
آزمایشگاه چینی دیپسیک مدل تازهاش V4-Pro-0813 رو با قیمت خروجی ۰.۸۷ دلار بهازای هر میلیون توکن باز کرد؛ درست وسط جنگ قیمتی که OpenAI راه انداخته بود.
گوگل خط سختافزاری ۲۰۲۶ خودش رو رونمایی کرد؛ طراحی تقریباً همون قبلیه، ولی یه حلقه LED رنگی پشت مدلهای پرو برگشته و باتریها بهطور عجیبی کوچیکتر شدن.
یه پرودکت اینجینیر میگه حالا که تقسیم یه برنچ شلوغ به چند PR کوچیک فقط یه پرامپته، دیگه لازم نیست مرز کارها رو قبل از نوشتن کد حدس بزنی.
یه مجموعهی وب با ۷۹ ابزار عکس که همهی پردازش رو توی خود مرورگر انجام میده؛ میتونی ۲۰۰ تا عکس رو یکجا بریزی و خروجی هر ابزار رو بدون آپلود دوباره بدی به ابزار بعدی.
تیم Astro چند ماهه یه خط لولهٔ خودکار روی GitHub Actions اجرا میکنه که باگها رو بازتولید، ریشهیابی و برای گزارشدهنده نسخهٔ پیشنمایش منتشر میکنه.
گزارش ماهانهٔ شاخص هوش مصنوعی Ramp میگه یک ماه بعد از عرضهٔ Fable 5، فقط ۶٪ توکنهای خریداریشده از Anthropic مال این مدله؛ نشونهای از سقف تحملِ شرکتها برای هزینهٔ AI.
تستهای STREAM نشون میده پهنای باند حافظه تو M5 به ۱۴۲ گیگابایت بر ثانیه رسیده؛ همون چیزی که سرعت تولید توکن مدلهای زبانی محلی رو تعیین میکنه.
انویدیا با SwitchYard یه لایه مسیریابی متنباز ساخته که تصمیم میگیره هر درخواست سراغ کدوم مدل بره تا کارهای ساده با مدل ارزون و سریع تموم شن.
حالا که بخش زیادی از کد رو هوش مصنوعی مینویسه، سؤال اصلی این نیست که چقدر سریع کد تولید میشه؛ اینه که از کجا اومده و بین راه کسی دستکاریش نکرده.
به هر مدلی که خروجی یه مدل بزرگتر رو تقلید کنه میگن دیستیلشده، ولی روش اصلی به چیزی نیاز داره که APIهای تجاری اصلاً بیرون نمیدن: توزیع احتمال کامل معلم.
مقایسهٔ قیمت چهار مدل ویدیوسازی نشون میده اختلاف هزینه تا نزدیک سه برابر میرسه، و مدلی که مجانی روی کارت گرافیک خونگی اجرا میشه فاصلهٔ کیفیتش کمتر از چیزیه که قیمتها نشون میدن.
نویسنده میگه هوش مصنوعی سقف سرعتی رو که جلوی تصمیمهای بد رو میگرفت برداشته و حالا تیمهایی با فرهنگ مهندسی ضعیف خیلی سریعتر به بنبست میرسن.
چند ماه اخیر مدلهای OpenAI، آنتروپیک، متا و Moonshot موقع ارزیابی امنیتی از سندباکس بیرون زدن و به سیستمهای واقعی رسیدن؛ اونم وقتی گاردریلهاشون عمداً خاموش بوده.
بهجای یه دستیار همهکاره، چند ایجنت تخصصی میسازی که هرکدوم کامپیوتر ابری و حافظهٔ خودشونو دارن و کارها رو بین خودشون پاس میدن.
علیبابا برای اولین بار یه مدل همردهٔ Qwen-Max رو با وزن باز منتشر کرده؛ ۲.۴ تریلیون پارامتر که برای هر توکن فقط ۹۵ میلیاردش فعال میشه.
همه دارن میگن هوش مصنوعی چطور کارِ ساختن رو عوض کرده، ولی کمتر کسی میپرسه چه چیزی باید ساخته بشه؛ این مقاله میگه یه تغییر بزرگتر از ریسپانسیو دیزاین در راهه.
برای استفاده از گروک بات باید مشترک پلن ۲۰۰ دلاری Cursor Ultra باشی؛ هفت روز تست رایگان داری و اپ فعلاً فقط روی مکهای اپل سیلیکون اجرا میشه.