AMD Instinct Coder: کدنویسی با AI روی سرور خودت
خلاصهٔ کاملتر
هزینهٔ کدنویسی با ایجنتهای AI داره سریع بالا میره و همین مسئله نقطهٔ شروع این معرفیه. Spectro Cloud مثال یه سازمان ۵۰۰ نفره رو میزنه: حدود یکسوم تیم کاربر سنگین هستن با ماهی ۵۰۰ تا بیش از ۱۰۰۰ دلار هزینه به ازای هر نفر، و دوسوم بقیه ماهی ۱۰۰ تا ۲۵۰ دلار. جمعش سالانه بین ۱.۴ تا ۳ میلیون دلار درمیاد، بدون هیچ سقفی، و کد و کانتکست داخلی هم با هر درخواست از سازمان بیرون میره.
AMD Instinct Coder جواب این شرکتها به اون مسئلهست: یه اپلاینس آمادهٔ on-prem که AMD و Supermicro و Spectro Cloud با هم اعتبارسنجی کردن. مدل باز GLM-5.2 روی GPUهای Instinct داخل خود سازمان اجرا میشه و توسعهدهنده همون ابزار همیشگیش مثل Claude Code یا Cursor یا VS Code رو دقیقاً مثل یه اندپوینت ابری بهش وصل میکنه. یعنی چیزی تو جریان کار روزمره عوض نمیشه.
قلب نرمافزاری ماجرا یه روتر هوشمنده که بین ابزار توسعهدهنده و مدلها میشینه. هر درخواست رو از نظر حساسیت، نوع کار و سهمیه بررسی میکنه و به مدل محلی میفرسته، و فقط وقتی سیاست سازمان یا توان مدل اجازه نده سراغ مدلهای ابری Anthropic یا OpenAI یا Google یا xAI میره. همهٔ درخواستها هم به تفکیک تیم و کاربر شمرده میشن و تو Grafana و Prometheus کنار هم دیده میشن.
از نظر سختافزار، پایهٔ کار یه سرور Supermicro مدل AS-8126GS-TNMR ـه با دو پردازندهٔ EPYC 9575F، هشت GPU از نوع Instinct MI325X، ۳ ترابایت رم DDR5 و دو کارت شبکهٔ Pensando Pollara ۴۰۰ گیگابیتی. لایهٔ PaletteAI Inference Launchpad از روی bare metal سیستمعامل، کلاستر Kubernetes، درایور GPU و سرویسهای inference رو بالا میاره و بعدش هم وصله و ارتقا و مقیاس رو مدیریت میکنه.
اعداد تبلیغاتی رو باید با احتیاط خوند. شرکت از ۷۰ درصد صرفهجویی نسبت به حالت فقطابری، بازگشت سرمایه در حدود ۶ ماه و رسیدن به ۹۵ درصد کیفیت مدلهای بزرگ حرف میزنه، ولی خودش هم پانویس زده که این ارقام روی یه سناریوی مدلسازیشدهٔ ۵۰ نفره حساب شدن و به میزان استفاده، ترکیب مدلها و قیمت مدلهای ابری بستگی داره. ظرفیت اعلامی هم ۵۰ توسعهدهنده روی هر نود با ۳۰ کاربر همزمانه.
نکات کلیدی:
- هر نود از ۵۰ توسعهدهنده و ۳۰ کاربر همزمان پشتیبانی میکنه.
- سختافزار: سرور Supermicro AS-8126GS-TNMR با ۲ عدد EPYC 9575F و ۸ عدد Instinct MI325X.
- مدل محلی GLM-5.2 ـه و مدلهای ابری فقط طبق سیاست تعریفشده وارد مدار میشن.
- ادعای ۷۰ درصد صرفهجویی و بازگشت سرمایهٔ ۶ ماهه روی سناریوی مدلسازیشدهٔ ۵۰ نفره حساب شده.
- پشتیبانی سختافزاری ۳ ساله در محل از طرف Supermicro و پشتیبانی کامل نرمافزاری از Spectro Cloud.




