Groq 3 LPX انویدیا وارد فاز تولید انبوه شد
خلاصهٔ کاملتر
به گزارش Wccftech، انویدیا در رویداد Hot Chips 2026 اعلام کرد که چیپ شتابدهندهٔ استنتاج Groq 3 LPX وارد فاز تولید انبوه شده. این چیپ به عنوان مکمل پلتفرم Vera Rubin طراحی شده و قراره سرعت تولید توکن (یعنی خروجی متن مدلهای زبانی) رو تو بارهای کاری عاملمحور (agentic) که به تاخیر کم حساسن، بالا ببره.
تو یکی از دموها، ترکیب Vera Rubin NVL72 و Groq 3 LPX رو مدل متنباز Gemma 4 31B، با پنجرهٔ زمینهٔ 100 هزار توکنی، به سرعت 3400 توکن در ثانیه رسیده که سریعترین عددیه که تا حالا رو این مدل ثبت شده. تو این معماری، جیپییوهای Rubin پردازش زمینهٔ بزرگ رو انجام میدن و LPX بخش رمزگشایی (decode) که به تاخیر حساسه رو شتاب میده.
نویسنده میگه این ترکیب باعث میشه کارهایی مثل کدنویسی با ایجنتهای هوش مصنوعی که قبلا ساعتها طول میکشید، به چند دقیقه برسه؛ یعنی نسبت به نزدیکترین رقیب، تا 4 برابر سرعت پاسخدهی بهتری داره. جنسن هوانگ، مدیرعامل انویدیا، Vera Rubin رو ادامهٔ مسیر Grace Blackwell برای شتابدادن به تولید هوش میدونه.
شرکت Nebius هم اعلام کرده اولین ارائهدهندهٔ کلود هست که Groq 3 LPX رو تو زیرساخت Nebius Token Factory به کار میگیره، اونم بدون نیاز به مهاجرت به یه استک جدید و از طریق همون API فعلی.
نکات کلیدی:
- چیپ Groq 3 LPX انویدیا وارد فاز تولید انبوه شده و مکمل پلتفرم Vera Rubin هستش
- تو دموی روی مدل Gemma 4 31B با پنجرهٔ 100 هزار توکنی، سرعت 3400 توکن در ثانیه ثبت شده
- کارهای عاملی مثل کدنویسی میتونن تا 4 برابر سریعتر از نزدیکترین رقیب انجام بشن
- Nebius اولین ارائهدهندهٔ کلوده که Groq 3 LPX رو تو Token Factory خودش به کار گرفته




