خیز بلند سربرس (Cerebras) برای پایان دادن به امپراتوری انویدیا؛ سریع‌ترین شتاب‌دهنده هوش مصنوعی معرفی شد

خیز بلند سربرس (Cerebras) برای پایان دادن به امپراتوری انویدیا؛ سریع‌ترین شتاب‌دهنده هوش مصنوعی معرفی شد
فهرست مطالب

در دنیای پرشتاب هوش مصنوعی، تامین قدرت پردازشی به گلوگاه اصلی شرکت‌های فناوری تبدیل شده است. در حالی که انویدیا (Nvidia) با تسلطی بی‌چون‌وچرا بر بازار تراشه‌های هوش مصنوعی پادشاهی می‌کند، شرکت سربرس (Cerebras Systems) با معرفی جدیدترین محصول خود، زلزله‌ای در این صنعت به پا کرده است. این شرکت با رونمایی از آنچه «سریع‌ترین شتاب‌دهنده هوش مصنوعی در صنعت» می‌نامد، مستقیماً تاج‌وتخت انویدیا را نشانه گرفته است. این اتفاق نه تنها نویدبخش کاهش هزینه‌ها برای توسعه‌دهندگان است، بلکه می‌تواند معادلات بازار سهام و آینده‌ی پردازش‌های ابری را به کلی تغییر دهد.

آغاز یک جنگ تمام‌عیار در بازار تراشه‌های هوش مصنوعی

بازار سخت‌افزارهای هوش مصنوعی تا پیش از این، حیاط خلوت انویدیا محسوب می‌شد. تراشه‌های سری H100 و مدل‌های جدیدتر بلک‌ول (Blackwell) این شرکت، استاندارد طلایی پردازش‌های سنگین برای آموزش مدل‌های زبانی بزرگ (LLMs) بوده‌اند. با این حال، تقاضای بی‌سابقه، قیمت‌های نجومی و کمبود عرضه، فضا را برای ظهور رقبای جدید باز کرده است. در ۲۴ ساعت گذشته، شرکت سربرس (Cerebras) با معرفی پلتفرم استنتاج (Inference) جدید خود، ادعا کرده است که محدودیت‌های فیزیکی و معماری پردازنده‌های گرافیکی (GPU) سنتی را در هم شکسته و سرعتی تا ۲۰ برابر بیشتر از راهکارهای فعلی انویدیا ارائه می‌دهد.

سربرس (Cerebras) دقیقاً چه چیزی را معرفی کرده است؟

تمرکز اصلی ادعای جدید سربرس، بر روی مرحله‌ی «استنتاج» یا Inference است. در دنیای هوش مصنوعی، ما دو مرحله اصلی داریم: اول «آموزش» (Training) که در آن مدل با حجم عظیمی از داده‌ها تغذیه می‌شود و دوم «استنتاج» که در آن مدلِ آموزش‌دیده، به سوالات کاربران پاسخ می‌دهد (مانند کاری که ChatGPT انجام می‌دهد). محصول جدید سربرس، یک سرویس استنتاج مبتنی بر ابر است که بر پایه تراشه‌های غول‌پیکر این شرکت (Wafer-Scale Engine) بنا شده است.

طبق داده‌های منتشر شده، این شتاب‌دهنده می‌تواند مدل‌های متن‌باز محبوبی مانند Llama 3 را با سرعتی بیش از ۱۰۰۰ توکن در ثانیه اجرا کند؛ رکوردی که پردازنده‌های فعلی انویدیا حتی به آن نزدیک هم نمی‌شوند. این سرعت خیره‌کننده به معنای پاسخ‌گویی در لحظه و بدون هیچ‌گونه تاخیر برای کاربران نهایی است.

معماری Wafer-Scale: راز سرعت خیره‌کننده سربرس

دلیل اصلی که سربرس می‌تواند چنین ادعای بزرگی را مطرح کند، تفاوت بنیادین در معماری تراشه‌های آن است. انویدیا و سایر رقبا مانند AMD، تراشه‌هایی را تولید می‌کنند که از قطعات کوچک سیلیکونی ساخته شده‌اند. وقتی مدل‌های هوش مصنوعی بزرگ می‌شوند، باید ده‌ها یا صدها عدد از این تراشه‌ها را به هم متصل کرد. این اتصال شبکه‌ای، باعث ایجاد پدیده‌ای به نام «دیوار حافظه» (Memory Wall) می‌شود؛ جایی که پردازنده‌ها به جای پردازش، منتظر رسیدن داده‌ها از تراشه‌های مجاور می‌مانند.

در مقابل، سربرس از یک رویکرد رادیکال استفاده می‌کند: ساخت یک تراشه به اندازه یک ویفر کامل سیلیکونی (بسیار بزرگ‌تر از یک پردازنده معمولی). این طراحی باعث می‌شود تمام هسته‌های پردازشی و حافظه روی یک قطعه یکپارچه قرار بگیرند و سرعت انتقال داده‌ها به شکل نجومی افزایش یابد.

ویژگی معماری گرافیکی سنتی (انویدیا) معماری Wafer-Scale (سربرس)
اندازه تراشه کوچک (نیاز به شبکه‌سازی ده‌ها تراشه) بسیار بزرگ (یکپارچه به اندازه یک تبلت)
پهنای باند حافظه محدود به اتصالات خارجی فوق‌العاده بالا (حافظه روی خود تراشه)
سرعت استنتاج (Inference) استاندارد (حدود ۱۰۰ تا ۳۰۰ توکن در ثانیه) بسیار بالا (بیش از ۱۰۰۰ توکن در ثانیه)
وابستگی نرم‌افزاری اکوسیستم قدرتمند CUDA در حال توسعه، پشتیبانی از PyTorch
معماری Wafer-Scale: راز سرعت خیره‌کننده سربرس

چرا انویدیا باید احساس خطر کند؟

تاثیر این خبر بر بازار فناوری بسیار فراتر از یک رقابت سخت‌افزاری ساده است. انویدیا در حال حاضر با ارزش بازار چند تریلیون دلاری، نبض وال‌استریت را در دست دارد. اما مزیت‌های رقابتی سربرس می‌تواند زنگ خطری برای این امپراتوری باشد:

  • کاهش هزینه‌های عملیاتی: سربرس ادعا می‌کند که هزینه استفاده از سرویس استنتاج این شرکت، کسری از هزینه‌های سرورهای ابری مبتنی بر انویدیا (مانند AWS یا Azure) است.
  • جذب توسعه‌دهندگان مستقل: با ارائه APIهای ارزان‌تر و سریع‌تر، استارتاپ‌های هوش مصنوعی که بودجه محدودی دارند، به سرعت به سمت پلتفرم‌های جایگزین جذب خواهند شد.
  • زمزمه‌های عرضه اولیه سهام (IPO): گزارش‌ها حاکی از آن است که سربرس در حال آماده‌سازی برای ورود به بورس است. موفقیت این محصول جدید می‌تواند ارزش‌گذاری این شرکت را به شدت افزایش دهد و سرمایه‌هایی که پیش از این فقط به سمت انویدیا می‌رفت را به سوی خود بکشاند.

«ما در سربرس معتقدیم که برای حل مشکلات جدید هوش مصنوعی، نمی‌توان از معماری‌های ۳۰ سال پیش استفاده کرد. سرعت استنتاج ما نشان می‌دهد که آینده متعلق به تراشه‌های یکپارچه و غول‌پیکر است.»

چالش‌های پیش روی سربرس

با وجود تمام این برتری‌های روی کاغذ، سربرس راه آسانی در پیش ندارد. بزرگترین مزیت انویدیا سخت‌افزار آن نیست، بلکه اکوسیستم نرم‌افزاری CUDA است. میلیون‌ها توسعه‌دهنده در سراسر جهان کدهای خود را بر اساس پلتفرم انویدیا بهینه‌سازی کرده‌اند. سربرس برای پیروزی در این نبرد، باید ثابت کند که مهاجرت کدهای هوش مصنوعی به سخت‌افزارش، بدون دردسر و با کمترین تغییرات نرم‌افزاری امکان‌پذیر است.

جمع‌بندی

معرفی سریع‌ترین شتاب‌دهنده هوش مصنوعی توسط سربرس، نشان‌دهنده بلوغ بازار سخت‌افزارهای AI است. دیگر قرار نیست انویدیا تنها بازیگر این میدان باشد. اگرچه شکست دادن اکوسیستم نرم‌افزاری انویدیا در کوتاه‌مدت بعید به نظر می‌رسد، اما رویکرد نوآورانه‌ی سربرس در معماری تراشه‌ها، گزینه‌ای جذاب، سریع و مقرون‌به‌صرفه را در اختیار توسعه‌دهندگان قرار می‌دهد. این رقابت در نهایت به نفع مصرف‌کننده نهایی تمام خواهد شد؛ چرا که به زودی شاهد ابزارهای هوش مصنوعی سریع‌تر، ارزان‌تر و هوشمندتر خواهیم بود.

سؤالات متداول

شرکت سربرس (Cerebras) چیست و چه تفاوتی با انویدیا دارد؟

سربرس یک شرکت سازنده سخت‌افزار هوش مصنوعی است که به جای ساخت تراشه‌های کوچک و اتصال آن‌ها به یکدیگر (روش انویدیا)، تراشه‌هایی بسیار بزرگ و یکپارچه به اندازه یک ویفر کامل سیلیکونی می‌سازد تا سرعت انتقال داده را به حداکثر برساند.

چرا سرعت استنتاج (Inference) در هوش مصنوعی مهم است؟

استنتاج همان مرحله‌ای است که هوش مصنوعی به درخواست کاربر پاسخ می‌دهد (مثل تولید متن توسط هوش مصنوعی). سرعت بالاتر به معنای تولید کلمات بیشتر در ثانیه و تجربه کاربری روان‌تر و بدون تاخیر است.

آیا سربرس می‌تواند جایگاه انویدیا را در بازار به خطر بیندازد؟

از نظر سخت‌افزاری و سرعت خالص در برخی وظایف، سربرس رقیب بسیار قدرتمندی است. اما انویدیا به دلیل داشتن اکوسیستم نرم‌افزاری بسیار محبوب CUDA، همچنان تسلط بالایی بر بازار دارد. با این حال، سربرس می‌تواند سهم قابل توجهی از بازار استارتاپ‌ها را به خود اختصاص دهد.

این رقابت چه تاثیری بر کاربران عادی دارد؟

رقابت بین غول‌های تراشه‌سازی باعث کاهش هزینه‌های پردازش ابری می‌شود. در نتیجه، شرکت‌ها می‌توانند سرویس‌های هوش مصنوعی (مانند دستیارهای صوتی یا تولیدکنندگان تصویر) را با سرعت بالاتر و قیمت کمتر یا حتی رایگان در اختیار کاربران عادی قرار دهند.

نکسینو در شبکه‌های اجتماعی:
فهرست مطالب

بلاگ های اخیر

نظرات کاربران

0 0 رای ها
امتیاز مقاله
اشتراک در
اطلاع از
0 نظرات
قدیمی‌ترین
تازه‌ترین بیشترین رأی
0
افکار شما را دوست داریم، لطفا نظر دهید.x