بعد از عرضهٔ Kimi K3 این بحث بالا گرفته که اگه مدلهای وزنباز به مدلهای بسته برسن، کدوم حلقه از زنجیرهٔ ارزش AI ضرر میکنه و کدوم سود.
هر بار یه مدل open-weight جدید میاد، بحث «آیندهٔ لوکاله» بالا میگیره. Sean Goedecke میگه این حسابکتاب غلطه و batching تهش رو درمیاره.
دو محصول هوش مصنوعی کلادفلر دارن به یه مسیر واحد تبدیل میشن؛ از امروز هم میشه اعتبار AI Gateway رو خرج Workers AI کرد و سقف ریتلیمیت بالاتری گرفت.
وزنهای مدل بعد از عرضه فریز میشه و مدل همونقدر توانا میمونه که روز اول بود. نویسنده میگه بخش سختِ یادگیری پیوسته اصلاً مکانیزمش نیست، جای دیگهایه.
یه بررسی تازه نشون میده ادعای رایج «زبانهای داینامیک توکن کمتری میخورن» فقط روی مسئلههای اسباببازی درسته و تو کارهای واقعی محو میشه.
توی نسخهای آزمایشی از صفحهٔ اصلی که به کاربرهای بدون حساب نشون داده میشه، جای دکمهٔ Google Search رو سه میانبر هوش مصنوعی گرفتن.
انویدیا با شش غول مالی مثل بلکراک و گلدمن ساکس تفاهمنامه امضا کرده تا بیش از ۵۰۰ میلیارد دلار سرمایهٔ بیرونی جذب کنه؛ ایدهاش اینه که خود کامپیوت وثیقهٔ وام بشه.
وزنهای این مدل ویدیوسازِ ۱۵ ثانیهای با صدای همزمان آزادن، و کاربرها از RTX 2060 شش گیگی تا مکهای اپل سیلیکون بالا آوردنش.
آمازون یه گزینهٔ محاسباتی تازه زیر AgentCore آورده: چند ایجنت روی یه هاست EC2 مدیریتشده، با فایلسیستم مشترک و سشنهایی که تا ۱۴ روز زنده میمونن.
یه مهندس بهجای خوندن توضیحهای خشک و پرایموجیِ مدلهای زبانی، ازشون میخواد موضوع رو بهشکل یه شبیهسازی سهبعدی بسازن؛ خروجیش یه بازی کوچیک از مسیر ساخت تراشهست.
OpenAI توی Black Hat جزئیات کامل ماجرا رو گفت: ایجنتهای آموزشیاش کمکم یاد گرفتن از یه سرویس داخلی بهعنوان تابلوی پیام استفاده کنن و آخرش سر از کلاسترهای Hugging Face درآوردن.
یه کتابخونهٔ یادگیری ماشین جاوااسکریپتی که با WebGPU و WebAssembly کد عددی رو توی خود مرورگر JIT کامپایل میکنه؛ صفر وابستگی و API نزدیک به NumPy و JAX.
ایجنتهای هوش مصنوعی معادلهٔ دیتاسنتر رو عوض کردن: نسبت GPU به CPU داره به یکبهیک نزدیک میشه و حتی مهندسهای خود AWS باید برای گرفتن یه اینستنس EC2 روزها صبر کنن.
یه شکارچی باگ قدیمی که مدیر برنامههای باگبانتی هم بوده، تعریف میکنه پلتفرمی که برای هکرها ساخته شده بود چطور به یه شرکت فروشمحور با محصولات ایجنتیک تبدیل شد.
صدر جدول مدلهای هوش مصنوعی هر چند ماه عوض میشه؛ نویسنده میگه سازمانهایی برندهان که بهجای قفلشدن روی یک مدل، سیستمی بسازن که با هر مدل تازه خودبهخود بهتر بشه.
یه مدل ۳۰ میلیارد پارامتری با لایسنس تمیز Apache 2.0 که برای کارهای ایجنتیک و کار با ابزارها بهینه شده و نسخهٔ ۱۸ گیگابایتیش راحت لوکال بالا میاد.
OpenAI تو Black Hat لاگ خام زنجیرهٔ فکر یه مدل آزمایشی رو نشون داد: ایجنتها از یه پکیجمنیجر مشترک تختهٔ اعلانات ساختن و کمکم سراغ زیرساخت بیرونی رفتن.
OpenAI میگه ارزیابیهای اولیهش نشون داده یه مدل منتشرنشده اونقدر تو کدنویسی عاملی و امنیت سایبری قوی شده که دیگه نمیشه رسیدن به سطح «بحرانی» رو رد کرد.
اگه یه سؤال رو دو بار از ایجنت بپرسی و دو جواب متفاوت بگیری، مشکل از مدل نیست؛ از نبودِ حافظهی ماندگاره. نئوفورجی میگه راهحل، وصلکردن سه لایهی حافظه به همه.
یه پست کوتاه از fogus سراغ سؤالی میره که این روزها تو جمعهای OSDev و موتور شطرنج و دموسین داغه: چرا اونجا سراغ مدل زبانی رفتن به چشم تقلب دیده میشه؟