تراشه Groq 3 LPX انویدیا وارد تولید انبوه شد
خلاصهٔ کاملتر
انویدیا تو رویداد Hot Chips 2026 اعلام کرد که تراشه استنتاج اختصاصیش به اسم Groq 3 LPX وارد تولید انبوه شده. این تراشه یه افزونهست برای پلتفرم دیتاسنتری Vera Rubin و هدفش اینه که سرعت تولید توکن (یعنی خروجی مدلهای زبانی) رو خیلی بالا ببره تا ایجنتهای هوش مصنوعی سریعتر جواب بدن. اولین مشتریای که رسما برای استفاده از این تراشه ثبتنام کرده هم شرکت Nebius Group هست.
ایجنتهای هوش مصنوعی برای انجام کارها باید تو یه حلقه پیوسته استدلال کنن، کد بنویسن و اجراش کنن، فایلهای سیستم رو چک کنن و از ابزارهای مختلف استفاده کنن؛ این یعنی باید هزارها توکن رو پشت سر هم پردازش کنن که گاهی باعث یه تاخیر به اسم decode latency (یعنی کند شدن مرحله تولید پاسخ بعد از پردازش اولیه) میشه. برای حل این مشکل، پلتفرم رکمقیاس Vera Rubin NVL72 که با دهها GPU نسل Vera Rubin کار میکنه، حالا میتونه پردازش زمینه رو از تولید توکن جدا کنه و این بخش دوم رو بسپاره به Groq 3 LPX.
طبق گفته انویدیا، یه رک کامل میتونه تا ۲۵۶ شتابدهنده از این خانواده رو با اتصالات پرسرعت به هم وصل کنه. تو تستهای شرکت Artificial Analysis، این تراشه با اجرای مدل متنباز Gemma 4 با ۳۱ میلیارد پارامتر و یه پنجره زمینه ۱۰۰ هزار توکنی، به سرعت ۳٬۴۰۰ توکن در ثانیه رسیده که رکورد محسوب میشه؛ انویدیا میگه این عدد چهار برابر رقباست و کارهای چندمرحلهای ایجنتها رو از چند ساعت به چند دقیقه میرسونه.
این تراشه از تکنولوژی شرکت کوچیکتر Groq ساخته شده؛ انویدیا دسامبر گذشته حدود ۲۰ میلیارد دلار برای لایسنس گرفتن از این فناوری پرداخت کرد و بنیانگذارش جاناتان راس و رئیسش سانی مدرا رو هم استخدام کرد. طبق گفته جنسن هوانگ، مدیرعامل انویدیا، این تراشه گام بزرگ بعدی تو مسیریه که با پلتفرمهای Grace Blackwell و NVL72 شروع شده بود.
تو همین رویداد، انویدیا اعلام کرد SpaceX هم به مشتریهای اصلیش اضافه شده و قراره معماری هوش مصنوعی نسل بعدیش رو روی Vera Rubin بسازه، از دیتاسنترهای زمینی تا ماهوارهها. چند تکنولوژی مکمل دیگه هم رونمایی شد: شبکه Spectrum-X Multiplane که خوشههایی تا ۵۱۲ هزار GPU رو مقیاسپذیر میکنه، پلتفرم Nvidia Scale-In برای امنیت و مدیریت داده، و NVLink Fusion برای وصل کردن پردازندهها و DPUهای سفارشی به رکهای نسل ششم NVLink.
نکات کلیدی:
- Groq 3 LPX تراشه استنتاج اختصاصی انویدیاست که حالا وارد تولید انبوه شده و برای شتابدادن به ایجنتهای هوش مصنوعی طراحی شده.
- هر رک میتونه تا ۲۵۶ شتابدهنده رو به هم وصل کنه و در تستها به ۳٬۴۰۰ توکن در ثانیه رسیده، چهار برابر رقبا.
- اولین مشتری رسمی این تراشه Nebius Group هست؛ SpaceX هم بهعنوان مشتری کلان پلتفرم Vera Rubin معرفی شده.
- انویدیا دسامبر ۲۰۲۵ حدود ۲۰ میلیارد دلار برای لایسنس فناوری Groq پرداخت کرده بود.




