یه گزارش تازه از a16z نشون میده عاملهایی که مستقیم با رابط کاربری کار میکنن از حالت دمو دراومدن و تو شرکتها ماهی میلیونها کار اداری تکراری رو انجام میدن.
یه توسعهدهنده حلقهٔ ترتیبی سرویس رفع آسیبپذیریش رو با یه استخر پنج ورکری عوض کرد و بچ ۳۰ مخزنی از ۴۶ دقیقه به ۱۲ دقیقه رسید؛ ولی بخش سخت ماجرا جای دیگهای بود.
تو تازهترین قسمتهای پادکست How I AI، یکی رباتی ساخته که پولریکوئستها رو نمره میده و کمریسکها رو خودش تأیید میکنه، و یکی دیگه کل کسبوکارش رو با چند فایل Skill میچرخونه.
تیم سازندهٔ گروک یه ابزار تازه معرفی کرده: ایجنتهایی که کامپیوتر ابری خودشونو دارن، توی اپهای روزمره لاگین میکنن و کار رو تا آخر میبرن؛ فعلاً هم تو مرحلهٔ بتاست.
قطعی پیاپی سرویسها، خاموش شدن یه مدل با دستور دولتی، و صورتحساب ایجنتها؛ سه اتفاق ۲۰۲۶ نشون داد تکیه بر یه ارائهدهندهٔ هوش مصنوعی فقط گرون نیست، خطر توقف کسبوکاره.
یه طراح موزیلا بهجای ساختن پروتوتایپ تو فیگما، فیچر رو با کمک Claude مستقیم داخل خود فایرفاکس اندروید پیاده کرد تا ببینه تست کاربردپذیری چقدر فرق میکنه.
گزارشها میگن OpenAI روی نسل بعدی مدلهاش کار میکنه و حتی به قانونگذارهای آمریکایی هم دربارش توضیح داده؛ مدلی که خودش از نظر امنیت سایبری «بحرانی» علامتش زده.
وقتی سورس Claude Code لو رفت معلوم شد از حدود ۵۱۲ هزار خط کد، بخش کمی با مدل حرف میزنه و بقیهش هارنسه؛ همون چیزی که کیفیت واقعی یه عامل رو تعیین میکنه.
مدیر خلاق یه آژانس تجربی میگه مشتریها حالا با تصویر آمادهٔ هوش مصنوعی سر جلسه میان؛ تصویرهایی که خیرهکنندهان ولی جواب بریف نیستن و اغلب اصلاً ساختنی نیستن.
شرکتهای معاملهگری خودمالک از کرنل لینوکس تا چیپ اختصاصی رو خودشون میسازن و بالاتر از بیگتک حقوق میدن؛ ولی امروز دیگه تأخیر کمتر برگ برنده نیست.
آنتروپیک اعلام کرده همهی متنهای کلود واترمارک نامرئی دارن، ولی نگفته این واترمارک چطور کار میکنه؛ این مطلب حدس میزنه کجا قایم شده و چطور میشه پاکش کرد.
انویدیا یه مدل متنباز کوچیک برای کارهای تکراری ایجنتها بیرون داده: ۳۰ میلیارد پارامتر که فقط ۳ میلیاردش فعاله، با فاینتیون حدود ۱۰۰ دلاری و زیر سه ساعت.
پرایم اینتلکت بهجای منوی ابزارها یه کرنل زندهی IPython گذاشته و مدل برای هر کاری پایتون مینویسه؛ نتیجهش کانتکست سبکتر و امکان اجرای کامل محلی روی DeepSeek V4.
یه پایپلاین عمومی نشون میده فقط با فایلهای عمومی روی هاگینگفیس میشه فهمید یه مدل واقعاً از صفر آموزش دیده یا روی وزنهای باز یکی دیگه سوار شده.
یه مدل ۵.۷۲ میلیارد پارامتری که بهجای دیستیل یا فاینتیون، وزن ۹۶۰ اکسپرت کدنویسی رو از یه مدل بزرگتر پیوند زده و با کوانتایز ۴ بیتی تو ۳.۳۶ گیگابایت VRAM جا میشه.
آنتروپیک میگه آزمایشگاههای چینی با هزاران حساب جعلی میلیونها مکالمه از Claude بیرون کشیدن. خودِ دیستیلیشن تکنیک عادی و رایجیه؛ چیزی که پرونده رو ساخته، نبودِ اجازهست.
یه توسعهدهنده حدود ۲۰۰۰ دلار و ۲ میلیارد توکن خرج کرد تا ببینه کدوم مدل هوش مصنوعی میتونه بدون دخالت آدم سه اپ موبایل کامل بسازه. نتیجه هم برنده داشت هم غافلگیری.
نویسنده که برای طراحی مدار چاپی از یه ابزار پایتونی به اسم cuflow استفاده میکنه، میگه حالا با چت کردن با ایجنتهای کدنویسی، کاری که قبلاً روزها طول میکشید رو خیلی سریعتر انجام میده.
انویدیا یه مدل متنباز ۳۰ میلیاردی منتشر کرده که قرار نیست باهوشترین باشه؛ قراره کارهای تکراری ایجنتها رو خیلی سریعتر و ارزونتر انجام بده.
یه مدل ۳۰ میلیارد پارامتری متراکم با لایسنس Apache 2.0 که مخصوص کارهای ایجنتی آموزش دیده و نسخهٔ ۴ بیتی رسمیش روی کارتهای گرافیک ۲۴ تا ۳۲ گیگی خونگی هم اجرا میشه.