در دنیای پرشتاب هوش مصنوعی، تامین قدرت پردازشی به گلوگاه اصلی شرکتهای فناوری تبدیل شده است. در حالی که انویدیا (Nvidia) با تسلطی بیچونوچرا بر بازار تراشههای هوش مصنوعی پادشاهی میکند، شرکت سربرس (Cerebras Systems) با معرفی جدیدترین محصول خود، زلزلهای در این صنعت به پا کرده است. این شرکت با رونمایی از آنچه «سریعترین شتابدهنده هوش مصنوعی در صنعت» مینامد، مستقیماً تاجوتخت انویدیا را نشانه گرفته است. این اتفاق نه تنها نویدبخش کاهش هزینهها برای توسعهدهندگان است، بلکه میتواند معادلات بازار سهام و آیندهی پردازشهای ابری را به کلی تغییر دهد.
آغاز یک جنگ تمامعیار در بازار تراشههای هوش مصنوعی
بازار سختافزارهای هوش مصنوعی تا پیش از این، حیاط خلوت انویدیا محسوب میشد. تراشههای سری H100 و مدلهای جدیدتر بلکول (Blackwell) این شرکت، استاندارد طلایی پردازشهای سنگین برای آموزش مدلهای زبانی بزرگ (LLMs) بودهاند. با این حال، تقاضای بیسابقه، قیمتهای نجومی و کمبود عرضه، فضا را برای ظهور رقبای جدید باز کرده است. در ۲۴ ساعت گذشته، شرکت سربرس (Cerebras) با معرفی پلتفرم استنتاج (Inference) جدید خود، ادعا کرده است که محدودیتهای فیزیکی و معماری پردازندههای گرافیکی (GPU) سنتی را در هم شکسته و سرعتی تا ۲۰ برابر بیشتر از راهکارهای فعلی انویدیا ارائه میدهد.
سربرس (Cerebras) دقیقاً چه چیزی را معرفی کرده است؟
تمرکز اصلی ادعای جدید سربرس، بر روی مرحلهی «استنتاج» یا Inference است. در دنیای هوش مصنوعی، ما دو مرحله اصلی داریم: اول «آموزش» (Training) که در آن مدل با حجم عظیمی از دادهها تغذیه میشود و دوم «استنتاج» که در آن مدلِ آموزشدیده، به سوالات کاربران پاسخ میدهد (مانند کاری که ChatGPT انجام میدهد). محصول جدید سربرس، یک سرویس استنتاج مبتنی بر ابر است که بر پایه تراشههای غولپیکر این شرکت (Wafer-Scale Engine) بنا شده است.
طبق دادههای منتشر شده، این شتابدهنده میتواند مدلهای متنباز محبوبی مانند Llama 3 را با سرعتی بیش از ۱۰۰۰ توکن در ثانیه اجرا کند؛ رکوردی که پردازندههای فعلی انویدیا حتی به آن نزدیک هم نمیشوند. این سرعت خیرهکننده به معنای پاسخگویی در لحظه و بدون هیچگونه تاخیر برای کاربران نهایی است.
معماری Wafer-Scale: راز سرعت خیرهکننده سربرس
دلیل اصلی که سربرس میتواند چنین ادعای بزرگی را مطرح کند، تفاوت بنیادین در معماری تراشههای آن است. انویدیا و سایر رقبا مانند AMD، تراشههایی را تولید میکنند که از قطعات کوچک سیلیکونی ساخته شدهاند. وقتی مدلهای هوش مصنوعی بزرگ میشوند، باید دهها یا صدها عدد از این تراشهها را به هم متصل کرد. این اتصال شبکهای، باعث ایجاد پدیدهای به نام «دیوار حافظه» (Memory Wall) میشود؛ جایی که پردازندهها به جای پردازش، منتظر رسیدن دادهها از تراشههای مجاور میمانند.
در مقابل، سربرس از یک رویکرد رادیکال استفاده میکند: ساخت یک تراشه به اندازه یک ویفر کامل سیلیکونی (بسیار بزرگتر از یک پردازنده معمولی). این طراحی باعث میشود تمام هستههای پردازشی و حافظه روی یک قطعه یکپارچه قرار بگیرند و سرعت انتقال دادهها به شکل نجومی افزایش یابد.
| ویژگی | معماری گرافیکی سنتی (انویدیا) | معماری Wafer-Scale (سربرس) |
|---|---|---|
| اندازه تراشه | کوچک (نیاز به شبکهسازی دهها تراشه) | بسیار بزرگ (یکپارچه به اندازه یک تبلت) |
| پهنای باند حافظه | محدود به اتصالات خارجی | فوقالعاده بالا (حافظه روی خود تراشه) |
| سرعت استنتاج (Inference) | استاندارد (حدود ۱۰۰ تا ۳۰۰ توکن در ثانیه) | بسیار بالا (بیش از ۱۰۰۰ توکن در ثانیه) |
| وابستگی نرمافزاری | اکوسیستم قدرتمند CUDA | در حال توسعه، پشتیبانی از PyTorch |

چرا انویدیا باید احساس خطر کند؟
تاثیر این خبر بر بازار فناوری بسیار فراتر از یک رقابت سختافزاری ساده است. انویدیا در حال حاضر با ارزش بازار چند تریلیون دلاری، نبض والاستریت را در دست دارد. اما مزیتهای رقابتی سربرس میتواند زنگ خطری برای این امپراتوری باشد:
- کاهش هزینههای عملیاتی: سربرس ادعا میکند که هزینه استفاده از سرویس استنتاج این شرکت، کسری از هزینههای سرورهای ابری مبتنی بر انویدیا (مانند AWS یا Azure) است.
- جذب توسعهدهندگان مستقل: با ارائه APIهای ارزانتر و سریعتر، استارتاپهای هوش مصنوعی که بودجه محدودی دارند، به سرعت به سمت پلتفرمهای جایگزین جذب خواهند شد.
- زمزمههای عرضه اولیه سهام (IPO): گزارشها حاکی از آن است که سربرس در حال آمادهسازی برای ورود به بورس است. موفقیت این محصول جدید میتواند ارزشگذاری این شرکت را به شدت افزایش دهد و سرمایههایی که پیش از این فقط به سمت انویدیا میرفت را به سوی خود بکشاند.
«ما در سربرس معتقدیم که برای حل مشکلات جدید هوش مصنوعی، نمیتوان از معماریهای ۳۰ سال پیش استفاده کرد. سرعت استنتاج ما نشان میدهد که آینده متعلق به تراشههای یکپارچه و غولپیکر است.»
چالشهای پیش روی سربرس
با وجود تمام این برتریهای روی کاغذ، سربرس راه آسانی در پیش ندارد. بزرگترین مزیت انویدیا سختافزار آن نیست، بلکه اکوسیستم نرمافزاری CUDA است. میلیونها توسعهدهنده در سراسر جهان کدهای خود را بر اساس پلتفرم انویدیا بهینهسازی کردهاند. سربرس برای پیروزی در این نبرد، باید ثابت کند که مهاجرت کدهای هوش مصنوعی به سختافزارش، بدون دردسر و با کمترین تغییرات نرمافزاری امکانپذیر است.
جمعبندی
معرفی سریعترین شتابدهنده هوش مصنوعی توسط سربرس، نشاندهنده بلوغ بازار سختافزارهای AI است. دیگر قرار نیست انویدیا تنها بازیگر این میدان باشد. اگرچه شکست دادن اکوسیستم نرمافزاری انویدیا در کوتاهمدت بعید به نظر میرسد، اما رویکرد نوآورانهی سربرس در معماری تراشهها، گزینهای جذاب، سریع و مقرونبهصرفه را در اختیار توسعهدهندگان قرار میدهد. این رقابت در نهایت به نفع مصرفکننده نهایی تمام خواهد شد؛ چرا که به زودی شاهد ابزارهای هوش مصنوعی سریعتر، ارزانتر و هوشمندتر خواهیم بود.
سؤالات متداول
شرکت سربرس (Cerebras) چیست و چه تفاوتی با انویدیا دارد؟
سربرس یک شرکت سازنده سختافزار هوش مصنوعی است که به جای ساخت تراشههای کوچک و اتصال آنها به یکدیگر (روش انویدیا)، تراشههایی بسیار بزرگ و یکپارچه به اندازه یک ویفر کامل سیلیکونی میسازد تا سرعت انتقال داده را به حداکثر برساند.
چرا سرعت استنتاج (Inference) در هوش مصنوعی مهم است؟
استنتاج همان مرحلهای است که هوش مصنوعی به درخواست کاربر پاسخ میدهد (مثل تولید متن توسط هوش مصنوعی). سرعت بالاتر به معنای تولید کلمات بیشتر در ثانیه و تجربه کاربری روانتر و بدون تاخیر است.
آیا سربرس میتواند جایگاه انویدیا را در بازار به خطر بیندازد؟
از نظر سختافزاری و سرعت خالص در برخی وظایف، سربرس رقیب بسیار قدرتمندی است. اما انویدیا به دلیل داشتن اکوسیستم نرمافزاری بسیار محبوب CUDA، همچنان تسلط بالایی بر بازار دارد. با این حال، سربرس میتواند سهم قابل توجهی از بازار استارتاپها را به خود اختصاص دهد.
این رقابت چه تاثیری بر کاربران عادی دارد؟
رقابت بین غولهای تراشهسازی باعث کاهش هزینههای پردازش ابری میشود. در نتیجه، شرکتها میتوانند سرویسهای هوش مصنوعی (مانند دستیارهای صوتی یا تولیدکنندگان تصویر) را با سرعت بالاتر و قیمت کمتر یا حتی رایگان در اختیار کاربران عادی قرار دهند.