نیویورکتایمز میگه OpenAI مدتها وانمود کرده نمیتونه لاگهای چتجیپیتی رو بگرده، در حالی که قبلاً همین کارو کرده بود.
انویدیا یه چارچوب معرفی کرده که توش ایجنتهای کدنویس بدون دخالت آدم سیاست ربات واقعی رو بهتر میکنن و تو کارهای ظریف به ۹۹ درصد موفقیت میرسن.
تیمها با هوش مصنوعی سریعتر از همیشه رابط کاربری میسازن، ولی همون کدها بهطور پیشفرض برای کاربرای معلول غیرقابلاستفادهان؛ این مقاله میگه راهحل، سیستمه نه ممیزی.
یه مهندس هوش مصنوعیِ خودآموخته ادعا میکنه با کمک Claude Code و پایتون تونسته «خطی A»، خط باستانی مینوسی که بیش از یه قرن رمزش نشکسته بود رو رمزگشایی کنه.
کوالکام که بیشتر با تراشههای موبایل شناخته میشه، حالا با یه پردازندهٔ سرور، شتابدهندهٔ جدید و خرید یه استارتاپ نرمافزاری ۳٫۹ میلیارد دلاری، جدی وارد بازار زیرساخت هوش مصنوعی شده.
توماس دومکه، مدیرعامل سابق گیتهاب، یه شبکهٔ میزبانی Git تازه راه انداخته که مخصوصِ دورانیه که ایجنتهای هوش مصنوعی اصلیترین تولیدکنندهٔ کدن و به پلتفرمها فشار میارن.
اسناد مالی لورفتهٔ OpenAI نشون میده درآمد این شرکت سریع رشد کرده ولی هزینههاش خیلی بیشتره؛ زیان عملیاتی ۲۰۲۵ به بیش از ۲۰ میلیارد دلار رسیده.
Mercury یه دستیار AI به اسم Command معرفی کرده که مستقیم داخل حساب مالیت کار میکنه: با زبان طبیعی ازش کار میخوای و اون تحلیل داده و انتقال پول رو انجام میده — هر اقدام هم با تأیید خودت.
انویدیا یه کتابخانهٔ بازمتن به اسم XR AI منتشر کرده که عینکهای AR و هدستهای واقعیت گسترده رو به مدلهای هوش مصنوعی روی GPU وصل میکنه تا ایجنت هم ببینه، هم بشنوه و هم ابزارهای سازمانی رو صدا بزنه.
تیم Wafer مدل هوش مصنوعی GLM-5.2 رو روی کارتهای AMD اجرا کرد و به ۸۰٪ سرعت Blackwell رسید، اونم با کمتر از نصف هزینه؛ تو این مقاله میگن چطور با چندتا ترفند فنی به این نتیجه رسیدن.
نویسنده استدلال میکنه کیفیت اکوسیستم متنباز تعیین میکنه که ایجنتهای AI کد سالم بسازن یا یه آشغالِ بهظاهر درست؛ و اینکه متنباز خودبهخود امن نیست.
IBM Research بنچمارکِ بازی به اسم ScarfBench معرفی کرده که میسنجه ایجنتهای هوش مصنوعی چقدر میتونن اپلیکیشنهای سازمانیِ جاوا رو بین فریمورکها مهاجرت بدن؛ نتیجه: هنوز خیلی ضعیف.
مومنتیک با یه بازطراحی بزرگ اومده که تست نرمافزار رو به ایجنتهای هوش مصنوعی میسپاره؛ ایجنتها خودشون تست مینویسن، خطاها رو تحلیل میکنن و آدم فقط گزارش رو مرور میکنه.
نویسنده بعد از ۱۵ سال برنامهنویسی توضیح میده چرا agentهای کدنویسی تو دست یه نفر معجزه میکنن ولی تو سازمانهای بزرگ اونطور که فکر میکنیم بهرهوری رو بالا نمیبرن.
پژوهشگرا نشون دادن اگه Claude Code یا Codex رو بذاری یه کتابخونه ناشناس رو از نظر امنیتی بررسی کنه، همون بررسی میتونه به اجرای کد مخرب روی سیستم خودت منجر بشه.
پایگاه ملی آسیبپذیری چین از توسعهدهندهها خواسته چند نسخهٔ اخیر Claude Code رو حذف کنن، با این ادعا که یه سازوکار نظارتی داخلی میتونه موقعیت و هویت کاربر رو به سرورهای راه دور بفرسته.
دیجیتالاوشن نسخهٔ مدیریتشدهٔ دیتابیس برداری Weaviate رو وارد پیشنمایش عمومی کرد؛ با قیمت ثابت ماهانه و بدون شارژ جداگانه برای هر کوئری یا هر بُعد.
ریلیزپد از روی کامیتهای گیتهابت با هوش مصنوعی یادداشتِ نسخه مینویسه؛ یه چنجلاگی که هم آدمها، هم گوگل و هم دستیارهای هوش مصنوعی میخوننش.
آمازون میخواد با فرستادن تیمهای مهندسی مستقیم به دل شرکتهای مشتری، سرعت راهاندازی سیستمهای هوش مصنوعی رو بالا ببره؛ کاری که OpenAI و Anthropic هم امسال شروع کردن.
جف گاتلف میگه «۹۵ درصد دقت» یه خروجیه، نه نتیجهٔ کلیدی. نتیجهٔ کلیدی باید رفتار آدمی رو اندازه بگیره که اون طرف خروجی مدل نشسته.