شرکت Tracebit یه رشته متن کوچیک رو داخل یه رمز قلابی (canary) مخفی کرده که وقتی ایجنت هوش مصنوعی مهاجم بخواد بخونتش، خودِ مکانیزم ایمنی مدل فعال میشه و حمله همونجا متوقف میشه.
مدل پرچمدار بعدی گوگل چند ماه عقب افتاده و دلیلش کدنویسیه — همون چیزی که این روزها مهمترین میدان رقابت مدلهاست.
ادعای «ما مسئولانه از AI استفاده میکنیم» راحته؛ اثباتش به یه ممیز مستقل سخته. فیگما رفته سراغ سختترش و گواهی بینالمللی گرفته.
یه مدل زبانی با ۲۶ میلیون پارامتر — حدود هزار برابر کوچکتر از GPT-4 — که نه مینویسه نه خلاصه میکنه؛ فقط فراخوانی تابع رو درست و سریع تحویل میده.
واحد تراشهٔ علیبابا استک SAIL رو در شانگهای اوپنسورس کرد و میگه مهاجرت به فریمورکهای رایج زیر هفت روز جواب میده؛ نشانهٔ فشار چین روی انحصار نرمافزاری انویدیا.
متا با Muse Image وارد رقابت تصویرسازی هوش مصنوعی شد؛ مدلی که از نانو بنانای گوگل جلو میزنه ولی هنوز به GPT Image 2 نرسیده.
کاخ سفید یه سازوکار هماهنگی تازه راه انداخته که گزارشهای آسیبپذیری زیرساختهای حیاتی رو یهجا جمع میکنه و با کمک هوش مصنوعی اولویت وصله رو مشخص میکنه.
یه مجموعهٔ متنباز از skillها که بعد از تمومشدن کار ایجنت روی diff اجرا میشن و خطاهای تکرارشوندهٔ کد تولیدشده با هوش مصنوعی رو قبل از commit بیرون میکشن.
اولین بتای عمومی iOS 27 حالا در دسترسه؛ بزرگترین آپدیت امسال اپل با Siri بازطراحیشده، افزایش سرعت حتی روی آیفونهای قدیمی و کلی تغییر ریز و مفید.
یه اپ دسکتاپ متنباز که چند ایجنت کدنویسی رو همزمان اجرا میکنه، هر تسک رو تو یه Git worktree جدا نگه میداره و دیفها و PRها رو از یه جا مدیریت میکنه.
اپل برای اجرای Apple Intelligence در چین سراغ شرکای محلی رفته؛ بایدو جستوجوی هوشمندش رو میسازه و مدل Qwen علیبابا هم پشت صحنه کار میکنه.
Endor Labs یه نسخهٔ رایگان معرفی کرده که از طریق MCP به دستیارهای کدنویسی هوش مصنوعی وصل میشه و همونجا آسیبپذیری، سکرت و پکیج مخرب رو تشخیص میده.
خروجی کلی و بیروح معمولاً تقصیر مدل نیست. این چارچوب ساده نشون میده جای خالی پرامپت دقیقاً کجاست و چطور پرش کنی.
پژوهشگرهای دیپمایند مدل تولید ویدیو رو به یه مدل عمومی بینایی تبدیل کردن که با دستور متنی، از تخمین عمق تا قطعهبندی رو یکمرحلهای انجام میده.
وقتی یه ایجنت ده بار کد مینویسه و تست میگیره و دیباگ میکنه، مدلی که یه بار درست جواب بده از مدل ارزونی که پنج بار تلاش میکنه ارزونتر تموم میشه.
برای فهمیدن اینکه یه ایجنت کدنویس واقعاً قبل از حذف فایل ازت اجازه میگیره یا نه، جستوجوی کلیدواژه جواب نمیده؛ این پروژه بهجاش نقشهٔ رفتار میسازه.
بزرگترین مدل اوپنویت تاریخ با ۲.۸ تریلیون پارامتر منتشر شد. نویسنده میگه بنچمارکها واقعیاند ولی با حداکثر تلاش گرفته شدن و فاصله با مدلهای بسته سر جاشه.
شرکت سازندهٔ مدلهای GLM دارد به یک میلیارد دلار فروش سالانه میرسه، در حالی که بهترین مدلهاش رو رایگان منتشر میکنه. عددها یه فرض مهم و چند هشدار جدی دارن.
طبق گزارش The Information، مدل بعدی OpenAI اول فقط به چند شریک نزدیک میرسه و دولت آمریکا مشتریبهمشتری تأیید میکنه؛ دقیقاً همون کاری که آنتروپیک داوطلبانه کرده بود.
وقتی یه تیم همزمان Copilot و Claude Code و Cursor و چندتا ایجنت خانگی رو اجرا میکنه، سؤال مدیرها این میشه: کی از چی استفاده میکنه، چقدر خرج داره و اصلاً امنه؟