شان گودکه میگه تو سیستمهای بزرگ، فهم ناقص از کدبیس یه شکست نیست؛ بهترین چیزیه که میشه داشت — و مهندس مؤثر با همون فهم ناقص تصمیم میگیره.
وقتی یه ایجنت ده بار کد مینویسه و تست میگیره و دیباگ میکنه، مدلی که یه بار درست جواب بده از مدل ارزونی که پنج بار تلاش میکنه ارزونتر تموم میشه.
برای فهمیدن اینکه یه ایجنت کدنویس واقعاً قبل از حذف فایل ازت اجازه میگیره یا نه، جستوجوی کلیدواژه جواب نمیده؛ این پروژه بهجاش نقشهٔ رفتار میسازه.
بزرگترین مدل اوپنویت تاریخ با ۲.۸ تریلیون پارامتر منتشر شد. نویسنده میگه بنچمارکها واقعیاند ولی با حداکثر تلاش گرفته شدن و فاصله با مدلهای بسته سر جاشه.
شرکت سازندهٔ مدلهای GLM دارد به یک میلیارد دلار فروش سالانه میرسه، در حالی که بهترین مدلهاش رو رایگان منتشر میکنه. عددها یه فرض مهم و چند هشدار جدی دارن.
طبق گزارش The Information، مدل بعدی OpenAI اول فقط به چند شریک نزدیک میرسه و دولت آمریکا مشتریبهمشتری تأیید میکنه؛ دقیقاً همون کاری که آنتروپیک داوطلبانه کرده بود.
وقتی یه تیم همزمان Copilot و Claude Code و Cursor و چندتا ایجنت خانگی رو اجرا میکنه، سؤال مدیرها این میشه: کی از چی استفاده میکنه، چقدر خرج داره و اصلاً امنه؟
اگه بشه دانش خطرناک یه مدل هوش مصنوعی رو مثل یه کلید خاموش و روشن کرد چی؟ پژوهشگرها روشی به اسم GRAM رو معرفی کردن که همین کارو با یه بار آموزش انجام میده.
صندوق تازهٔ گوگل کلاد برای اکوسیستم ۱۲۰ هزار عضوی شرکاست تا نمونهسازی و استقرار AI عاملی رو سرعت بده؛ بخشی از پول هم میره پای مهندسهای مستقر.
یه محقق امنیتی با کمک آخرین مدل OpenAI و فقط حدود ۲۵ دلار هزینه، یه زنجیرهٔ باگ پیش از احراز هویت تو هستهٔ وردپرس پیدا کرد که تهش به اجرای کد از راه دور میرسه.
بهجای اینکه هر دستور رو تکتک بدی و نتیجه رو چک کنی، یه هدف با شرط موفقیت روشن تعریف میکنی و ایجنت خودش تا رسیدن بهش میچرخه.
سازندهٔ Devin تیم TierZero رو جذب کرده تا کارشون روی خودکارسازی و مهار حوادث به خود Devin اضافه شه.
تیم Unit 42 یک فریمورک باتنت اینترنت اشیا رو کالبدشکافی کرده که سازندهش بخش زیادی از کدش رو با مدل زبانی نوشته — و ردپای همین ماجرا توی باگهاش پیداست.
یه گزارش حادثهٔ امنیتی طنز که نشون میده وقتی امنیت زنجیرهٔ تأمین رو کامل به عاملهای هوش مصنوعی بسپری، چه اتفاقی میافته.
کسپرسکی یه کمپین فیشینگ رو تحلیل کرده که قربانی رو میفرسته کدشو روی صفحهٔ واقعی و معتبر مایکروسافت وارد کنه؛ و همونجا مهاجم توکن نشستش رو میدزده.
یه اسکریپت پایتونی لرزون هر ماه فاکتورهای یه استارتاپ ۱۰۰ میلیون دلاری رو صادر میکرد؛ داستان ششماههٔ تعمیرش نشون میده مشکل هیچوقت خود کد نبوده.
آزمایش روی حدود ۱۰۳۰ تسک ایجنتی نشون داد Kimi K3 و Fable 5 تقریباً همسطحن، ولی نقاط قوتشون جاهای متفاوتیه — و ترکیبشون از هر دو بهتر درمیآد.
دو شرکتی که دو سال شریک هوش مصنوعی بودن، حالا رو در روی هم تو دادگاهن؛ اپل میگه OpenAI با کمک کارمندهای سابقش اسناد محرمانه رو بیرون برده.
نسخهی ۱۱.۱۸ خط فرمان npm استراتژی نصب linked رو از آزمایشی به پایدار رسوند و دستورهای تأیید اسکریپت نصب رو هم مرتبتر کرد.
با اضافهکردن یه فایل Dockerfile.vercel به پروژهت، هر سروری که HTTP حرف بزنه رو Vercel میسازه، ذخیره میکنه، دیپلوی و اسکیل میکنه — و فقط بابت CPUـیی که واقعاً مصرف کردی پول میدی.