یه کلاینت API که فایلهای .http رو مثل شهروند درجهیک میبینه، با Tauri و Rust ساخته شده و هیچ حساب کاربری و تلهمتریای نمیخواد.
یک دایرکتور مهندسی سهساله میگه نصف قواعد قدیمی مدیریت روی فرضِ گرون بودن کد بنا شده بودن و اون فرض فرو ریخته؛ نصف دیگه دستنخورده و مهمتر از قبل شده.
یه ابزار تازه با همون API رسمی تایپاسکریپت محدودهٔ ممکن هر عدد رو موقع بیلد حساب میکنه تا NaN و تقسیم بر صفر و ایندکس بیرون از آرایه رو قبل از اجرا پیدا کنی.
نویسنده میگه «چی»ِ یه نفر تقریباً همیشه «چطور»ِ یه نفر دیگهست؛ و بالا رفتن تو درخت تصمیم با سؤال چرا، گزینههایی رو برمیگردونه که زودتر بسته بودی.
یه پکیج توسعه برای لاراول که پیامکهای خروجی رو قبل از رفتن به سرویس واقعی میگیره و تو یه داشبورد محلی، داخل ماکاپ گوشی نشون میده.
یه مجموعهٔ متنباز از skillها که بعد از تمومشدن کار ایجنت روی diff اجرا میشن و خطاهای تکرارشوندهٔ کد تولیدشده با هوش مصنوعی رو قبل از commit بیرون میکشن.
وقتی برنامه روی یه ورودی بزرگ کرش میکنه و نمیدونی کجاش مقصره، یه ابزار ساده میتونه ورودی رو تا ۹۹٪ کوچیک کنه و باگ رو جلوی چشمت بذاره.
نویسنده میگه اگه خواستهات رو با زبان صوری مثل Lean بنویسی، ایجنت میتونه هم پیادهسازی و هم اثبات ماشینخوانش رو بسازه و دیگه لازم نباشه کسی کد رو بخونه.
تیم Neon یه کلاینتِ psqlِ کاملاً TypeScript رو داخل neonctl کار گذاشته که وقتی psqlِ بومی نصب نباشه خودکار فعال میشه؛ جالبتر اینکه کدش رو تقریباً کامل یه ایجنتِ هوش مصنوعی نوشته.
یه اسکنر متنباز نوشتهشده با Rust که با قواعد آگاه از درخت نحو کد رو میگرده، مسیر داده از منبع تا نقطهٔ خطرناک رو دنبال میکنه و مستقیم به Code Scanning وصل میشه.
ایجنتهای کدنویس معمولاً فقط دربارهٔ کد حدس میزنن؛ این CLI بهشون اجازه میده اپ رو واقعاً روی دستگاه باز کنن، ببینن و شواهدش رو بردارن.
نقشهی نسخهی ۱۲ نستجیاس عمومی شده: پکیجهای اصلی به ESM میرن، Rspack جای وبپک رو میگیره و دکوریتورهای روت از Zod و Valibot پشتیبانی میکنن.
۶۰٪ مشکلات مدلهای زبانی تو production رو اول کاربرها پیدا میکنن، نه مهندسها. راهحلش یه دیسیپلین خستهکننده ولی حیاتیه: ارزیابی.
یه بنچمارک جدید ایجنتهای کدنویسی رو با تسکهای واقعی و طولانی محک میزنه؛ جایی که حتی قویترین مدل هم فقط تونست کمتر از نصف کارها رو تموم کنه.
وقتی ایجنت یه اپ کامل رو توی یه بعدازظهر میسازه، هیچکس نمیدونه کدوم فایلها واقعیان؛ Evil Martians یه بستهٔ اسکیل ساخته که این آشفتگی رو توی Storybook قابل دیدن میکنه.
قسمت دهم سری Ship AI with Laravel سراغ سؤالی میره که کسی دوست نداره: کدی رو که به OpenAI وصله چطور تست کنیم؟ جواب، سیستم fake خود SDK و تستهاییه که هیچوقت به شبکه نمیزنن.
IBM Research بنچمارکِ بازی به اسم ScarfBench معرفی کرده که میسنجه ایجنتهای هوش مصنوعی چقدر میتونن اپلیکیشنهای سازمانیِ جاوا رو بین فریمورکها مهاجرت بدن؛ نتیجه: هنوز خیلی ضعیف.
مومنتیک با یه بازطراحی بزرگ اومده که تست نرمافزار رو به ایجنتهای هوش مصنوعی میسپاره؛ ایجنتها خودشون تست مینویسن، خطاها رو تحلیل میکنن و آدم فقط گزارش رو مرور میکنه.
یه ابزار خط فرمان که کد پروژهت رو میگرده و بلوکهایی که از یه جا به جای دیگه کپی شدن رو پیدا میکنه؛ حتی وقتی خطها جابهجا شدن یا یه دستور بینشون کم و زیاد شده.
تیم QuestDB نشون میده با دو تغییر کاملاً منصفانه تو بنچمارک معروف ClickBench، بدون دستزدن به کوئری یا داده، میشه جدول رتبهبندی دیتابیسها رو کامل بههم ریخت.