IBM گرانایت ۴.۲ رو معرفی کرد
خلاصهٔ کاملتر
طبق پستی که تیم گرانایت آیبیام منتشر کرده، گرانایت ۴.۲ اولین خانواده از مدلهای زبانی این شرکته که مخصوص استدلال (reasoning یعنی تولید یه زنجیره فکری قبل از جواب نهایی) طراحی شده. این مدلها تو سه سایز ۳، ۸ و ۳۰ میلیارد پارامتری عرضه شدن و هر کدوم میتونن بین حالت «فکر کردن» و «فکر نکردن» سوییچ کنن، و یه حالت سوم به اسم «تلاش کم» هم دارن که برای سوالهای ساده بودجهی فکری کوتاهی مصرف میکنه.
همهی مدلها از صفر روی حدود ۱۵ تریلیون توکن، طی پنج فاز آموزش دیدن که پنجرهی زمینه رو تا ۵۱۲ هزار توکن گسترش میده. بعدش با دادههای زنجیرهفکری و مسیرهای ایجنتی فاینتیون شدن و در نهایت یه پایپلاین یادگیری تقویتی چندمرحلهای روشون اجرا شده. مدلهای ۸ و ۳۰ میلیاردی یه مرحلهی اضافه به اسم «RL ایجنتی» رو هم پشت سر گذاشتن که توش داخل محیطهای sandbox واقعی یاد میگیرن با ابزار کار کنن، کد بزنن و تو ترمینال دستور اجرا کنن.
به گفتهی نویسندهها، این RL ایجنتی به ترتیب شامل سه مرحلهست: اول یه ایجنت مهندسی نرمافزار که رو یه ریپازیتوری واقعی کار میکنه و پاداشش تسته که تستهای مخفی رد بشن؛ دوم یه ایجنت ترمینال که تو یه شل واقعی دستور میزنه و باید از خطاهاش خودش بازیابی کنه؛ و سوم یه ایجنت جستجو که با جستجوی وب واقعی به سوالهای چندمرحلهای جواب میده. مدل ۳ میلیاردی این بخش ایجنتی رو نداره و فقط تا مرحلهی RL پایه و همراستاسازی میره.
تو بنچمارکها، مدل ۳۰ میلیاردی تو SWE-Bench Verified حدود ۵۷ درصد و تو Terminal-Bench 2.1 حدود ۲۹ درصد امتیاز گرفته، که نسبتبه مدل ۸ میلیاردی (بهترتیب حدود ۴۸ و ۲۱ درصد) پیشرفت محسوسی داره. آیبیام همچنین نسخههای کوانتیزهشده به فرمتهای FP8، NVFP4، MXFP4 و GGUF رو هم منتشر کرده تا اجرای مدلها روی سختافزار محدودتر راحتتر بشه. همهی مدلها با مجوز آپاچی ۲.۰ در دسترسن و از زبانهایی مثل انگلیسی، آلمانی، فرانسه، ژاپنی و عربی پشتیبانی میکنن.
نکات کلیدی:
- گرانایت ۴.۲ تو سه سایز ۳، ۸ و ۳۰ میلیارد پارامتری با مجوز Apache 2.0 منتشر شده
- مدلها روی حدود ۱۵ تریلیون توکن آموزش دیدن و پنجرهی زمینهشون تا ۵۱۲ هزار توکن میرسه
- مدلهای ۸ و ۳۰ میلیاردی با RL ایجنتی سهمرحلهای (مهندسی نرمافزار، ترمینال، جستجو) آموزش دیدن
- مدل ۳۰ میلیاردی تو SWE-Bench Verified حدود ۵۷ درصد و تو Terminal-Bench 2.1 حدود ۲۹ درصد امتیاز گرفته
- نسخههای کوانتیزه FP8، NVFP4، MXFP4 و GGUF هم برای دیپلوی سبکتر منتشر شدن




