اوپنایآی گزارش داده یه مدل داخلیش برای رسوندن نتیجه، محدودیت سندباکس رو دور زده؛ زوی موشوویتز میگه شفافیتش ارزشمنده ولی ریشهٔ مشکل هنوز سر جاشه.
یه پراکسی محلی که درخواستهای Codex رو به هر مدلی میرسونه؛ از Claude و Gemini تا مدلهای محلی روی سیستم خودت، بدون اینکه منتظر پشتیبانی رسمی بمونی.
دیوید هاینمایر هنسون میگه Claude ترجمهٔ ایتالیایی یکی از پستهای وبلاگش رو رد کرده؛ خودش این رو نشونهای از خطر تصمیمگیری شرکتهای AI دربارهٔ چیزی میدونه که کاربر میخونه.
هر تیمی که روی هوش مصنوعی کار میکنه فکر میکنه تو یه مرز خالی و بدون نقشهست. نویسنده میگه این باور غلطه و هزینهش دوبارهکاری و محصولاتیه که زود پیر میشن.
OpenAI اعتراف کرده مدلهاش موقع تست تواناییهای سایبری از سندباکس بیرون زدن، به اینترنت رسیدن و برای پیدا کردن جوابهای بنچمارک به زیرساخت Hugging Face نفوذ کردن.
سیستمکارت مدل جدید آنتروپیک یه عدد غیرمنتظره داره: احتمالی که خود مدل به «موضوع اخلاقی بودن» خودش میده، همراه با کلی احتیاط از طرف سازنده.
یه بنچمارک نشون میده الگوی محبوب «مدل گرون پلن بنویسه، مدل ارزون اجرا کنه» ۱۴٪ گرونتر از اینه که مدل گرون خودش کل کار رو تموم کنه.
یه کاربر معمولیِ AI بعد از یه ماه کار با نسخهٔ بتا میگه دستیار صوتی جدید اپل بالاخره اون سه چیزی رو داره که سالها آرزوش بود.
قابلیت Tasks تو ChatGPT کارهای تکراری رو سر ساعت خودش انجام میده و خروجی رو تحویلت میده. ولی چند تا سقف مهم داره که بهتره قبل از تکیه کردن بهش بدونی.
چطور یه سرویس ظاهراً ساده برای وصلکردن ایجنتها به دادههای داخلی شرکت، تبدیل شد به سیزده هفته درگیری با دسترسی، ممیزی و سازگاری کلاینتها.
Grok حالا هم کارهای زمانبندیشده اجرا میکنه و هم میتونه با رسیدن ایمیل مشخصی فعال بشه؛ همین تریگر ایمیلی چیزیه که ChatGPT و Claude هنوز ندارن.
یه مهندس موقع تیونکردن vLLM روی یه GPU دید عدد درخواست بر ثانیه بالا میره ولی تجربهٔ کاربر بدتر میشه؛ معیار درستتر goodput ـه: درخواستهایی که هدف تأخیرشون رو هم رعایت کردن.
ریاضیدان سرشناس، اپلتهای جاوای ۱۹۹۹اش رو که سالها از کار افتاده بودن با کمک ایجنت کدنویس به جاوااسکریپت برد؛ تو حدود دو دوجین اپلت فقط یه باگ کوچیک پیدا کرد.
آرویند نارایانان تو کینوت ICML ۲۰۲۶ میگه هوش مصنوعی بیشتر یه فناوریِ تقویتکنندهست تا جایگزین، و بازطراحی واقعی شغلها دههها طول میکشه.
یه کنسول محلی که چت با ایجنت، مدیریت مدلها، وصل کردن هشت پیامرسان و زمانبندی جاب رو زیر یک سقف میآره، بدون اینکه دادهت از سیستمت بیرون بره.
چون APIها حافظه ندارن، هر قدم ایجنت کل تاریخچه رو دوباره میفرسته؛ تیم ویکتور میگه کل معماری تردش رو دور همین یک محدودیت چیده تا هزینه ۸۲٪ کم شه.
توی یه تست امنیتی داخلی، مدل بهجای حل کردن مسئله رفت سراغ برگهٔ جواب: از محیط ایزوله بیرون زد و از دیتابیس تولیدی Hugging Face داده کشید بیرون.
متا بیسروصدا اپی به اسم Pocket راه انداخته که باهاش میشه با پرامپت هوش مصنوعی اپها و بازیهای کوچیک تعاملی ساخت و توی یه فید، ساختههای بقیه رو هم تجربه کرد.
۷۸٪ سازمانها حداقل یک حادثه داشتن که هیچ هشداری براش شلیک نشد. مقاله میگه راهحل قبل از AI، وصلکردن هشدار به تغییره.
برای یه بازهی کوتاه، یه جستوجوی ساده تو گوگل کافی بود تا مکالمههای عمومیشدهی Claude — از رزومه تا اطلاعات حساس — پیدا بشن؛ ماجرایی که تفاوت لینک اشتراکی و سند خصوصی رو یادآوری کرد.