کلود به زودی مهارت AI شما را نمره میده
خلاصهٔ کاملتر
آنتروپیک داره یه قابلیت جدید به کلود اضافه میکنه که به جای اینکه مدل رو ارزیابی کنه، سراغ خود کاربر میره. این ویژگی با نام AI Fluency Scorecard در تنظیمات کلود رویت شده و قراره بگه شما چقدر خوب با هوش مصنوعی کار میکنی.
وقتی کاربر این قابلیت رو فعال کنه، کلود مکالمات قبلی رو در سه محیط — Chat (گفتگوی معمولی)، CoWork (همکاری روی پروژه) و Claude Code (کدنویسی) — اسکن میکنه و یازده شاخص رفتاری رو بررسی میکنه. خروجی یه گزارش ساختاریافتهست که نشون میده هر شاخص «نشان داده شده»، «جزئی» یا «مشاهده نشده» بوده.
این یازده شاخص دور سه محور اصلی میچرخن: Delegation (تفویض — مثل اینکه آیا هدف رو قبل از درخواست توضیح میدی)، Description (توصیف — مثل مخاطب خروجی، فرمت، لحن و نمونهها) و Discernment (تشخیص — مثل اینکه آیا ادعاهای مدل رو چک میکنی یا منطق اشتباه رو میگیری). این ساختار برگرفته از چارچوب 4D AI Fluency ایه که آنتروپیک با دو محقق دانشگاهی توسعه داده.
نمره نهایی بهصورت یه کسر نمایش داده میشه — مثلاً ۷.۵ از ۱۱ — و کنارش راهنمایی هست که بگه کدام مهارتها باید تقویت بشن. پرامپت سیستم این ویژگی خیلی دقیقه؛ مثلاً برای شاخص «بررسی استدلال» صرف تأیید مدل ("makes sense") امتیاز نمیده — فقط اعتراض مشخص به یه نقص یا تناقض حساب میشه.
این قدم بعدی منطقی بعد از تحقیق AI Fluency Index فوریه ۲۰۲۶ آنتروپیکه که روی تقریباً ۹۸۳۰ مکالمه ناشناس بررسی کرد. اون مطالعه نشون داد تکرار و اصلاح تدریجی بهترین شاخص استفاده مؤثر از AIه، در حالی که تکیه بیش از حد به خروجیهای آماده مثل artifacts و کد، بررسی انتقادی رو کاهش میده. Scorecard این یافته رو تبدیل به یه حلقه بازخورد شخصی میکنه.
هنوز مشخص نیست این ویژگی برای همه پلنها میآد یا اول برای مشتریان سازمانی. در هر صورت، این یکی از اولین تلاشهای جدی یه آزمایشگاه بزرگ AIه که میخواد نه مدل، بلکه طرف انسانی مکالمه رو ارزیابی کنه.
نکات کلیدی:
- کلود مکالمات کاربر رو اسکن و ۱۱ شاخص رفتاری رو ارزیابی میکنه
- نمره بهصورت کسری از ۱۱ نمایش داده میشه با راهنمای بهبود
- سه محور اصلی: Delegation، Description و Discernment
- پایه این کار تحقیق روی ۹۸۳۰ مکالمه ناشناس در اوایل ۲۰۲۶ بوده
- تاریخ عرضه و اینکه برای چه پلنهایی خواهد بود هنوز مشخص نیست




