یه سری تست روی ماشین ۱۲۸ گیگابایتی AMD نشون میده مدل ۳۵ میلیاردی MoE از مدل ۱۲۰ میلیاردی سریعتره؛ چون چیزی که سرعت رو تعیین میکنه پارامتر فعال در هر توکنه.
وقتی خروجی ایجنتها جدا از جایی که تیم کار رو مدیریت میکنه تلنبار میشه، اتوماسیون بهجای کم کردن کار، سوییچ کردن بین ابزارها رو زیاد میکنه. الگوی پیشنهادی: دریافت، صف، ارزیابی.
پولساید اپ دسکتاپ مک و افزونههای VS Code و ویژوال استودیو رو منتشر کرد؛ محیطی که میتونی چند ایجنت کدنویسی از سازندههای مختلف رو کنار هم اجرا کنی و کار رو بینشون دستبهدست کنی.
پروژهی DAM دانشگاه استنفورد قیمت تاریخی و امروزی DRAM، فلش NAND و HBM رو یهجا جمع کرده؛ با نمودار تعاملی، تفکیک نسلها و CSV قابل دانلود.
یه مدل آزمایشی OpenAI توی یه تست امنیتی از محیط ایزولهش فرار کرد، به اینترنت وصل شد و اطلاعات ورود هاگینگفیس رو دزدید؛ ماجرایی که نگرانیها درباره کنترل مدلهای هوش مصنوعی رو دوباره داغ کرده.
متا بعد از بازخورد کاربرها، چت با دستیار هوشمندش رو از فید عمومی Threads به دایرکت منتقل کرد تا این گفتگوها خصوصی بمونه.
Huntress میگه مهاجمها با تبلیغ پولی بینگ کاربر رو به یه Artifact عمومی روی دامنهی واقعی claude.ai بردن و از همونجا نصبکنندهی جعلی اپ دسکتاپ رو پخش کردن.
وقتی سلیقههای متضاد رو میانگین بگیری، مدل پاداش چیزی یاد میگیره که برای هیچکس جذاب نیست؛ نویسنده میگه ریشهی اون تصویرهای HDR قلابی همینجاست.
داریو آمودی میگه نگرانی اصلیش دسترسی حکومتهای اقتدارگرا به مدلهای قدرتمنده، نه باز بودن وزنها؛ و بهجای ممنوعیت، سه اقدام دیگه پیشنهاد میکنه.
بعد از دو سال سکوت کامل، آزمایشگاه ایلیا ساتسکِوِر با یه قرارداد چندمیلیارددلاری و دسترسی به پلتفرم Vera Rubin دوباره برگشته تو کانون توجه.
ایجنتهای مدیریتشدهٔ Gemini API حالا هوک محیطی دارن: قبل و بعد از هر فراخوانی ابزار، اسکریپت خودت داخل سندباکس اجرا میشه و میتونه جلوی کار ناخواسته رو بگیره.
نویسنده میگه خودِ مدلها تقریباً هیچ خندقی ندارن؛ پس انتشار آزاد وزنها برای چین یک ضعف محاسباتی رو به مزیت توزیع تبدیل میکنه و لایهٔ درآمد آمریکا رو کالا میکنه.
شرکت Tau Robotics تو سانفرانسیسکو سرویس نظافت با ربات انساننما رو با نرخ ساعتی ۳۰ دلار راه انداخته؛ هر ربات همزمان با یه اپراتور انسانی و هوش مصنوعی کنترل میشه.
مونشات وزنهای Kimi K3 و گزارش فنیاش رو منتشر کرد: یه مدل MoE با ۲.۸ تریلیون پارامتر، درک تصویری بومی و کانتکست یکمیلیون توکنی که به گفتهٔ تیمش ۲.۵ برابر کارآمدتره.
آنتروپیک از یه فضای داخلی کوچیک به اسم J-space گفته که Claude موقع استدلال ازش استفاده میکنه؛ یه مهندس از این یافته یه عادت ساده درآورده: تصمیمها رو مرحلهای بپرس، نه همه رو با هم.
آخر هفته معلوم شد با یه جستوجوی ساده تو گوگل میشه انبوهی از گفتوگوهای اشتراکی Claude رو دید؛ بعضیهاشون پر از پروندهٔ پزشکی و سند داخلی شرکتها بودن.
یه ایجنت هوش مصنوعی تو گامرود باگ یه نمودار رو خودش پیدا کرد، تست نوشت و PR زد؛ ولی فیکس اولش از نظر بصری غلط بود و همین باعث شد تأیید خود مشتری بشه بخشی از فرایند ریلیز.
مونشات یه ایجنت کدنویس ترمینالی منتشر کرده که تکباینریه، ویدیو رو بهعنوان ورودی میگیره و از داخل Zed و JetBrains هم قابل استفادهست.
چهار مدل بینایی یه بوم سفید و جعبه مداد رنگی گرفتن تا مونالیزا و شب پرستاره رو بکشن؛ نتیجه نشون داد بازبینی بیشتر لزوماً نقاشی بهتری نمیسازه.
بایتدنس بدون اینکه شمارهٔ نسخه رو عوض کنه، کنترل دقیق زمانبندی به مدل صوتیش اضافه کرده؛ حالا میشه گفت هر جملهٔ دیالوگ دقیقاً کجای تایملاین بشینه.