غول دنیای پردازندههای گرافیکی، انویدیا، در جریان رویداد Hot Chips از آغاز تولید انبوه سیستم یکپارچه Vera Rubin و شتابدهنده نسل جدید Groq 3 LPX پرده برداشت. این پلتفرم با تمرکز بر نسل آینده سیستمهای خودکار و ایجنتهای هوش مصنوعی (Agentic AI)، جهشی خیرهکننده در سرعت تولید توکن و پردازش پنجرههای متنی عظیم رقم زده است.
با گذر صنعت از مرحله آموزش مدلها به سمت استنتاج چندمرحلهای و استدلال پیچیده، تقاضا برای زیرساختهای فوقسریع بهشدت افزایش یافته است. معماری نوین انویدیا پاسخی صریح به چالشهای اقتصادی، تاخیر پردازشی و مقیاسپذیری زیرساختهای ابری در سالهای پیش رو به شمار میرود.
چرخش استراتژیک به سمت استنتاج: چرا ایجنتهای هوش مصنوعی نیازمند سختافزار تازهاند؟
در سالهای اخیر، تمرکز اصلی شرکتهای فناوری بر آموزش مدلهای زبانی حجیم (LLMs) بود. اما با گسترش ایجنتهای هوش مصنوعی (AI Agents) که وظیفه تفکر چندمرحلهای، برنامهنویسی خودکار و اجرای کارهای همزمان را برعهده دارند، نقطه ثقل پردازش به سمت استنتاج (Inference) و پردازش بلادرنگ تغییر کرده است.
ایجنتها برای دستیابی به خروجی منطقی، نیازمند پنجرههای زمینه (Context Window) بسیار بزرگ هستند و به طور مداوم میلیاردها توکن تولید و ردوبدل میکنند. سرورهای سنتی زیر بار سنگین این حجم از درخواستهای همزمان با افت بازدهی و هزینههای گزاف روبهرو میشوند؛ موضوعی که انویدیا را به طراحی یکپارچه تمام لایههای دیتاسنتر سوق داده است.
سیستم Vera Rubin و Groq 3 LPX؛ ثبت رکورد ۴ برابری در سرعت تولید توکن
معماری جدید انویدیا که در قالب رکهای مقیاسبزرگ Vera Rubin NVL72 و سیستم شتابیافته Groq 3 LPX وارد فاز تولید انبوه شده، برای حذف گلوگاههای پردازشی ساخته شده است. طبق بنچمارکهای مستقل موسسه Artificial Analysis بر روی مدل متنباز Gemma 4 31B، این معماری توانسته است به رکورد شگفتانگیز ۳۴۰۰ توکن در ثانیه در پردازش پنجرههای متنی ۱۰۰ هزار توکنی دست یابد.
این سرعت خروجی تا ۴ برابر سریعتر از نزدیکترین رقبای فعال در بازار است و هزینههای عملیاتی به ازای هر توکن را به میزان چشمگیری کاهش میدهد.
جدول مقایسه ویژگیهای کلیدی پلتفرم Vera Rubin
| ویژگی / مولفه | مشخصات فنی و کارکرد | مزیت برای هوش مصنوعی |
|---|---|---|
| شتابدهنده Groq 3 LPX | تولید توکن فوق سریع با معماری تاخیر فوقکم | تعامل بلادرنگ و بدون وقفه برای ایجنتهای نرمافزاری |
| پردازندههای مرکزی Vera | بهینهسازیشده برای تسکهای منطقی و پیچیده | مدیریت کارآمد جریان داده در دیتاسنترها و ماموریتهای خاص |
| شبکه Spectrum-X Multiplane | سوییچینگ چندصفحهای مسطح بدون افت بسته (Lossless) | ارتباط پرسرعت بین رکی بدون گلوگاه شبکه |
طراحی مشترک نهایی (Extreme Codesign): رمز موفقیت انویدیا
انویدیا در نسل جدید دیتاسنترهای خود رویکرد Extreme Codesign را در پیش گرفته است. در این شیوه، چیپ پردازشی، حافظه، سوییچهای شبکه و لایههای نرمافزاری بهطور مجزا ساخته نمیشوند، بلکه از مرحله نقشه اولیه بهصورت یک کارخانه یکپارچه هوش مصنوعی (AI Factory) همگامسازی میگردند.
- پردازش زمینه طولانی: پردازندههای Vera Rubin تحلیل دادههای با حجم بالا را با کمترین مصرف انرژی ممکن میسازند.
- ارتباطات بدون تاخیر: پلتفرم شبکه اترنتی Spectrum-X انتقال میلیاردها پارامتر را در سراسر کلاسترها هدایت میکند.
- تولید سریع خروجی: چیپهای LPX مسئولیت تبدیل آنی دادهها به توکنهای خوانا را بر عهده دارند.
استقبال غولهای فناوری: از دیتاسنترهای ابری تا ماموریتهای مداری SpaceXAI
رونمایی از این محصول جدید بلافاصله با اعلام همکاری شرکتهای تراز اول جهان همراه شد. پذیرش این پلتفرم نشاندهنده اعتماد بازار به استراتژی انویدیا در حوزه هوش مصنوعی مولد است:

- SpaceXAI: قصد دارد نسل بعدی هوش مصنوعی ایجنتمحور خود را هم در مراکز داده زمینی و هم در ماهوارههای مداری بر پایه پردازندههای Vera CPU توسعه دهد.
- Nebius: بهعنوان نخستین ارائهدهنده خدمات ابری، سیستمهای Groq 3 LPX را به زیرساخت Token Factory خود اضافه کرده تا توسعهدهندگان بتوانند دستیارهای بلادرنگ کدنویسی و پاسخگویی را بدون تاخیر مستقر کنند.
- CoreWeave: برای بهبود پهنای باند و شبکه بدون افت، سوییچینگ Spectrum-X Multiplane را مستقیماً در فاز عملیاتی پیادهسازی کرده است.
تاثیر بر بازار و آینده رقابت در صنعت تراشه
معرفی نسل جدید تراشههای انویدیا فشار را بر سایر رقبا نظیر AMD و کوالکام دوچندان میکند. انویدیا با اتصال مستقیم معماری Rubin به اکوسیستمهای استنتاج سریع، تلاش دارد وابستگی شرکتها به معماریهای متفرقه را از بین برده و مدل درآمدی خود را بر پایه تبدیل مقیاسپذیر توکن به ارزش تجاری تثبیت کند.
جمعبندی
ورود معماری Vera Rubin و سیستمهای Groq 3 LPX به خط تولید انبوه، نشانهای روشن از ورود به عصر طلایی استنتاج و ایجنتهای هوش مصنوعی است. با همگرایی قدرت پردازش، شبکه فوقپیشرفته و معماری کمتاخیر، انویدیا نهتنها جایگاه پیشتازی خود را حفظ کرده، بلکه زیرساخت لازم برای استقلال و هوشمندی بیشتر هوش مصنوعی در سالهای آینده را فراهم آورده است.
سؤالات متداول
سیستم NVIDIA Groq 3 LPX چه کاربردی دارد؟
این سیستم یک زیرساخت شتابیافته استنتاج با تاخیر بسیار اندک است که بهطور ویژه برای افزایش فوقالعاده سرعت تولید توکن در سیستمهای هوش مصنوعی خودکار (ایجنتها) طراحی شده است.
معماری Vera Rubin چه مزیتی در پردازش زمینه (Context) دارد؟
پلتفرم Vera Rubin به همراه پردازندههای Vera توانایی تحلیل و پردازش پرسرعت پنجرههای متنی بزرگ تا بیش از ۱۰۰ هزار توکن را با ۴ برابر سرعت بیشتر نسبت به سایر سیستمها فراهم میسازد.
کدام شرکتهای بزرگ از فناوری جدید انویدیا استفاده خواهند کرد؟
شرکتهایی مانند SpaceXAI برای دیتاسنترها و سیستمهای مداری، Nebius برای ارائهدهنده خدمات ابری تولید توکن و CoreWeave برای شبکههای ابری یکپارچه از این پلتفرم استفاده میکنند.
فناوری Spectrum-X Multiplane چیست؟
یک راهکار شبکه اترنتی پیشرفته است که رکهای Vera Rubin را از طریق سوییچهای موازی با پهنای باند بسیار بالا و بدون اتلاف داده به یکدیگر متصل میکند.