«caveman»: به ایجنت یاد بده مثل غارنشین حرف بزنه
خلاصهٔ کاملتر
این ریپازیتوری ابزاری به اسم caveman رو معرفی میکنه؛ یه اسکیل یا پلاگین برای Claude Code (و به گفتهٔ نویسنده بیش از ۳۰ ایجنت دیگه مثل Codex، Gemini، Cursor و Copilot) که کاری میکنه مدل «مثل آدمغارنشین» حرف بزنه: کوتاه، تلگرافی و بدون حرف اضافه. ادعاش اینه که حدود ۷۵٪ از توکنهای خروجی رو کم میکنه ولی دقت فنی رو کامل نگه میداره—به قول خودش «مغز هنوز بزرگه، فقط دهن کوچیک شده».
برای مثال، جایی که Claude معمولی تو ۶۹ توکن توضیح میده چرا یه کامپوننت React دوباره رندر میشه، نسخهٔ caveman همون جواب رو تو ۱۹ توکن میده: رفرنس آبجکت هر رندر عوض میشه، بذارش تو useMemo. چند سطح فشردهسازی هم داره—از lite (فقط حذف پرکنندهها) تا full، ultra (تلگرافی) و حتی wenyan (چینی کلاسیک، از همه کوتاهتر)—که با یه دستور بینشون جابهجا میشی.
نکتهٔ مهم اینه که زبون جوابت رو عوض نمیکنه؛ اگه فارسی یا پرتغالی بنویسی، caveman هم به همون زبون کوتاه جواب میده—فقط سبک رو فشرده میکنه، نه زبون رو، و کد و دستور و رشتهٔ خطا رو هم دستنخورده نگه میداره. کنارش چند زیرمجموعه داره مثل caveman-commit برای پیامهای کوتاه commit، caveman-review برای کامنتهای تکخطی PR و caveman-compress که فایلهای حافظه مثل CLAUDE.md رو فشرده میکنه.
به گفتهٔ نویسنده، بنچمارکها روی توکنهای واقعی API بهطور میانگین ۶۵٪ کاهش خروجی (بین ۲۲ تا ۸۷٪) نشون میدن و مقایسه هم منصفانه با دستور «مختصر جواب بده» انجام شده، نه با حالت پرحرفِ پیشفرض. یه نکتهٔ مهم هم اینه که caveman فقط روی توکنهای خروجی اثر میذاره و به توکنهای استدلال/thinking دست نمیزنه؛ برد اصلیش خوانایی و سرعته و صرفهجویی هزینه یه امتیاز اضافهست.
جالب اینکه به یه مقالهٔ مارس ۲۰۲۶ به اسم «Brevity Constraints Reverse Performance Hierarchies in Language Models» ارجاع میده که ادعا میکنه محدود کردن مدلهای بزرگ به جوابهای کوتاه، دقتشون رو تو بعضی بنچمارکها ۲۶ امتیاز بالا برده—یعنی پرحرفی همیشه بهتر نیست. کل پروژه هم بخشی از یه اکوسیستم بزرگتر (caveman-code، cavemem، cavekit و cavegemma) با لایسنس MITه.
نکات کلیدی:
- caveman جواب ایجنتهای AI رو تلگرافی و کوتاه میکنه و حدود ۷۵٪ توکن خروجی رو کم میکنه بدون افت دقت.
- با Claude Code، Codex، Gemini، Cursor و بیش از ۳۰ ایجنت دیگه کار میکنه.
- چند سطح فشردهسازی (lite، full، ultra، wenyan) داره و زبون جواب رو حفظ میکنه.
- فقط روی توکن خروجی اثر داره، نه توکنهای thinking؛ برد اصلی خوانایی و سرعته.
- بنچمارکها میانگین ۶۵٪ کاهش خروجی (۲۲ تا ۸۷٪) رو نشون میدن.




