حافظهٔ کاری Claude کوچیکتر از تصور ماست
خلاصهٔ کاملتر
آنتروپیک اخیراً پژوهشی منتشر کرده دربارهٔ سازوکاری به اسم J-space: یه فضای کاری داخلی کوچیک که به نظر میرسه Claude موقع استدلال چندمرحلهای ازش استفاده میکنه. یادآوری روان و گرامر پایه از این مسیر رد نمیشن؛ اون چیزی که این فضا رو فعال میکنه استدلال واقعیه: رسیدن قدمبهقدم به یه جواب پنهان، برنامهریزی برای جلوتر، یا گرفتن چیزی که کسی بهش اشاره نکرده.
مثالی که تو خود مقالهٔ پژوهشی اومده گویاست: به Claude میگی «تعداد پاهای حیوونی که تار میتنه» و درست قبل از جواب «۸»، الگوی «عنکبوت» تو J-space روشن میشه. اگه وسط تولید همون الگو رو با «مورچه» عوض کنی، جواب میشه «۶». یعنی این فضا واقعاً بخشی از زنجیرهٔ استدلاله، نه صرفاً بازتاب تصمیمی که جای دیگهای گرفته شده.
نکتهای که برای نویسنده جالب بوده، اندازهست. به تعبیر خود آنتروپیک، J-space هر بار فقط «چند ده مفهوم» رو نگه میداره و کمتر از یکدهم کل فعالیت پردازش داخلی مدل رو تشکیل میده؛ ضمناً توکنبهتوکن تغییر میکنه، نه اینکه یه بودجهٔ ثابت برای کل گفتوگو باشه.
نویسنده میگه عادت قبلیاش این بود که همهٔ چیزی که میدونه رو تو یک پیام بریزه: «لاگ ورود به اپ لاراولی اضافه کن، با ایونت، IP و user agent رو ذخیره کن، داشبورد بساز، TDD باشه و احراز هویت فعلی هم خراب نشه.» به گفتهٔ خودش مشکل طول پرامپت نیست، اینه که شش تصمیم بیربط — معماری، طراحی اسکیما، رابط کاربری، استراتژی تست، سازگاری با گذشته — همزمان پرسیده شدن و ناچار یکیشون رقیق میشه.
راهحلی که پیشنهاد میکنه مرحلهای کردنه، نه جزئیات بیشتر: اول فقط سؤال معماری («لیسنر روی ایونتهای داخلی لاراول یا یه aggregate رویدادمحور؟ اول تریدآف رو توضیح بده»)، بعد روی همون جواب تثبیتشده سؤال بعدی (اسکیمای رکورد لاگ)، بعد تستهای شکستخورده. یه نکتهٔ دیگه هم از همون پژوهش برداشته: گفتن «به چیزی فکر نکن» اون مفهوم رو کامل خاموش نمیکنه، فقط ضعیفش میکنه، پس دستور مثبت بهتر میشینه تا منفی.
در عین حال خودش صریح میگه این یه تکنیک اثباتشده نیست: J-space سازوکاری درون یک مرحلهٔ تولیده، نه ادعایی دربارهٔ طول پرامپت یا اندازهٔ گفتوگو، و آنتروپیک هم یافتهها رو در حد دسترسی به اطلاعات چارچوببندی کرده. حرف نویسنده اینه که این عادت مستقل از پژوهش هم جواب داده: تصمیم کمتر تو هر پرامپت، جواب قابلاعتمادتر.
نکات کلیدی:
- J-space فضای کاری کوچیکیه که فقط موقع استدلال واقعی فعال میشه، نه برای یادآوری روان
- ظرفیتش چند ده مفهومه و کمتر از ۱۰٪ فعالیت داخلی مدل رو میگیره
- کارهای تکراری مثل ساخت migration نیازی به مرحلهای شدن ندارن
- تصمیمهای معماری و حالتهای مرزی رو تکتک بپرس و روی جواب قبلی بساز
- دستور مثبت («این کارو بکن») از دستور منفی («این کارو نکن») بهتر جواب میده
- نویسنده تأکید میکنه این یه قیاس عملیه، نه نتیجهگیری مستقیم از پژوهش




