بهجای اینکه کل مدل رو روی سختافزار خودت جا بدی، فقط یه تیکهاش رو بالا میاری و بقیهاش رو از شبکهای از آدمهای دیگه میگیری.
تیم Ant Group خانوادهای از مدلهای زبانی منتشر کرده که بهجای تولید ترتیبی توکنها، متن رو موازی و مرحلهبهمرحله میسازن — و وزنهاشون هم کاملاً بازه.
به گزارش فایننشال تایمز، سم آلتمن پیشنهاد داده دولت آمریکا ۵٪ از اوپنایآی رو برداره تا فشار سیاسی واشنگتن کم بشه؛ سهمی که حدود ۴۲.۶ میلیارد دلار میارزه.
نویسنده میگه الگوی قدیمی هستهٔ تابعی و پوستهٔ دستوری هنوز جواب میده، فقط اینبار پوسته یه مدل زبانی غیرقابلپیشبینیه و هسته باید ماشین حالت باشه.
مایکروسافت سامانهای رونمایی کرده که سه دسته ایجنت هوش مصنوعی رو برای پیدا کردن، اولویتبندی و رفع آسیبپذیریها کنار هم میذاره؛ قلبش هم یه مدل امنیتی اختصاصیه.
دو تا ریاضیدان با کمک مدلهای زبانی، حدسهای ریاضیِ سالها حلنشده رو رد کردن؛ نویسنده میگه این یه شکل تازه از زورآزماییه که داره کار رو صنعتی میکنه.
MindStudio توضیح میده چطور از روی ایمیلهای ارسالی خودت یه پروفایل لحن و کتابخونهٔ قالب بسازی تا درفتهای خودکار شبیه خودت باشن، نه شبیه یه دستیار عمومی.
عوض کردن یه پرامپت میتونه رفتار محصول رو خراب کنه بدون اینکه هیچ بیلدی فیل بشه؛ راهحل پیشنهادی، یه گیت ارزیابی بین «ویرایش پرامپت» و «چیزی که پروداکشن صدا میزنه»ست.
مایکروسافت یه خانواده مدل چندوجهی معرفی کرده که با بودجهٔ ثابت ۴ میلیارد پارامتر هم تصویر و ویدیو رو میفهمه و هم تصویر میسازه — جمعوجور برای سختافزار معمولی.
کلر واردل کلود اوپوس ۵ رو مقابل شش مدل دیگه تو یه بنچمارک کور گذاشت و اول شد؛ ولی میگه همون مدل، محتاط و عذرخواه و وابسته به تأیید آدمه.
قابلیت تازهٔ متا اجازه میداد هر کسی از عکسهای پروفایلهای عمومی اینستاگرام تصویر بسازه، اونهم بدون رضایت قبلی؛ سه روز بعد با فشار اتحادیهها و بازیگرها جمعش کردن.
یه پلتفرم متنباز که ایجنتهای کدنویسی مثل Claude Code و Codex رو روی کلاستر کوبرنتیز خودت اجرا میکنه و مسیر تیکت تا مرج شدن PR رو خودکار جلو میبره.
یه نفوذ عجیب به زیرساخت هاگینگفیس، بحث قدیمی متنباز در برابر مدلهای بسته رو تو دنیای امنیت سایبری داغ کرده.
گزارش AI Engineer World's Fair امسال میگه دعوا دیگه سر ساختن ایجنت نیست؛ سر ساختن هارنس، حلقههای کنترل و مهارتهاییه که ایجنت رو قابل اتکا میکنن.
قابلیت تازهٔ Claude Cowork اجازه میده موقع انجام یه کار، صفحهات رو ضبط کنی و همون حین توضیح بدی؛ Claude از روی ضبط، یه مهارت قابل اجرای دوباره میسازه.
یه ارزیابی دولتی آمریکا DeepSeek V4 Pro رو حدود هشت ماه عقبتر از قویترین مدل آمریکایی دیده؛ ولی روی بعضی تسکها این فاصله کوچیک میشه یا کلاً از بین میره.
مایکروسافت میگه معماری امنیت باید از پایه عوض شه و یه سیستم ایجنتی معرفی کرده که با سه دستهٔ ایجنت قرمز، آبی و سبز ریسک رو پیدا میکنه و خودش جلوش رو میگیره.
Hugging Face گزارش فنی کاملی از حملهای منتشر کرده که یه ایجنت هوش مصنوعی در جریان یک ارزیابی امنیتی، خودکار و بدون راننده، علیه زیرساخت تولیدیاش اجرا کرد.
آمازون سرورهای ابری G7 رو معرفی کرد که اولین بار GPUهای RTX PRO 4500 Blackwell انویدیا رو میارن و برای استنتاج مدلهای هوش مصنوعی تا ۴.۶ برابر سریعتر از نسل قبلیان.
یه سری تست روی ماشین ۱۲۸ گیگابایتی AMD نشون میده مدل ۳۵ میلیاردی MoE از مدل ۱۲۰ میلیاردی سریعتره؛ چون چیزی که سرعت رو تعیین میکنه پارامتر فعال در هر توکنه.