کلود کد واقعا مخفیانه ضعیفتر شده؟
خلاصهٔ کاملتر
سوال اصلی مقاله اینه: آیا انتروپیک واقعا مخفیانه کلود کد رو ضعیفتر کرده؟ جواب دقیق نه، ولی تجربهی کاربر تقریبا همونی بوده که انگار بله. تو چند ماه گذشته سه تا مشکل جدا از هم روی هم انباشته شدن و هرکدوم بدون هیچ توضیح رسمی، کلود کد رو یهکم بیکیفیتتر کردن.
اولی مربوط به reasoning effort بود؛ یعنی میزان محاسباتی که مدل قبل از جواب دادن صرف فکر کردن میکنه. تو ماه مارس انتروپیک سطح پیشفرضشو از بالا به متوسط پایین آورد و بعدا هم رسما تایید کرد این یعنی یهکم هوش کمتر در ازای جواب سریعتر و کمتر گیر کردن تو محدودیت مصرف. ولی این تغییر به کاربرا اطلاع داده نشد، برای همین اول متوجه افت کیفیت شدن و بعد دلیلشو فهمیدن.
دومی یه باگ تو مکانیزم کش بود که تو نشستهای طولانی، استدلالهای قبلی مدل رو حذف میکرد. نتیجهش این بود که کلود انگار حافظه نداشت و مسائلی که قبلا حل کرده بود رو دوباره از اول حل میکرد یا تکرار میکرد.
سومی یه دستورالعمل داخلی برای کوتاهتر کردن جوابها بود که ظاهرا باید مفید میبود ولی باعث افت ۳ درصدی تو عملکرد کدنویسی شد؛ یعنی یه افت قابلاندازهگیری، نه فقط یه حس کلی. استلا لورنزو، مدیر هوش مصنوعی AMD، تو همین دوره گفت دیگه نمیشه رو کلود برای کارهای پیچیده مهندسی حساب کرد.
انتروپیک بخشی از اینها رو پذیرفته؛ تغییر reasoning effort و دلیلشو تایید کرده و هر سه مشکل رو درست کرده، ولی میگه عمدا هوش مدل رو کم نکرده و APIش هم تحت تاثیر این مشکلات نبوده. نویسنده میگه این فرق فنی و حقوقی مهمه، ولی برای کاربری که کلود کد ابزار روزمرهشه، فرقی نمیکنه مشکل تو لایه محصول بوده یا تو خود مدل؛ تجربهش هفتهها بدتر بوده.
این ماجرا کنار یه نکته دیگه هم قرار میگیره: طبق مستندات خود انتروپیک، بعضی درخواستهای حساس میتونن بدون اطلاع کاربر از Opus 5 به Opus 4.8 یا مدلهای دیگه سوییچ کنن. Opus 5 هم با وجود نمرههای بالا تو بنچمارک، طبق گفته توسعهدهندههایی مثل تئو براون و تست Code Rabbit، تو کار روزمره پرحرف و بیشازحد کاملگراست. قیمتش هم بالاتر از رقبایی مثل GPT-5.6 و Grok 4.6 هست، در حالی که طبق گزارشها Fable 5 فقط سهم کمی از هزینههای کاربرای آمریکایی رو گرفته.
نکات کلیدی:
- انتروپیک تو مارس سطح پیشفرض reasoning effort رو از بالا به متوسط پایین آورد و بعدا این افت هوش رو تایید کرد
- یه باگ کش حافظهی نشستهای طولانی کلود رو خراب کرده بود؛ یه دستورالعمل کوتاهکردن جواب هم باعث افت ۳ درصدی عملکرد کدنویسی شد
- استلا لورنزو (AMD) گفته تو این دوره دیگه نمیشده رو کلود برای کارهای پیچیده مهندسی حساب کرد
- انتروپیک میگه عمدا مدل رو ضعیف نکرده و API تحت تاثیر نبوده، ولی هر سه مشکل رو بعد از هفتهها شکایت درست کرد
- بعضی درخواستهای حساس بدون اطلاع کاربر میتونن از Opus 5 به مدلهای دیگه سوییچ بشن




