پژوهشگر OpenAI سیستم‌های هوش مصنوعی Cerebras را شگفت‌انگیز توصیف کرد

پژوهشگر OpenAI سیستم‌های هوش مصنوعی Cerebras را شگفت‌انگیز توصیف کرد
شرکت OpenAI سیستم‌های شرکت Cerebras، شریک Helios ای‌ام‌دی، را در پردازش وظایف استنتاج «شگفت‌انگیز» توصیف کرد.
فهرست مطالب

به‌نظر می‌رسد که انتخاب Cerebras به‌عنوان شریک AMD در مسیر تقویت قابلیت‌های استنتاجی سیستم رک‌اسکیل Helios بسیار هوشمندانه بوده است؛ چراکه اخیراً یک پژوهشگر شرکت OpenAI نیز ستایش بزرگی را نثار موتور مقیاس ویفر (Wafer-Scale Engine) شرکت Cerebras کرده است.

به گزارش Wccftech، سیستم هلیوس اولین راهکار ای‌ام‌دی در مقیاس رک برای کارهای هوش مصنوعی است و از اجزای زیر تشکیل شده است:

  • پردازنده‌های گرافیکی AMD Instinct MI455X
  • پردازنده‌های مرکزی نسل ششم AMD EPYC
  • کارت‌های شبکه هوش مصنوعی AMD Pensando (NICs)
  • واحد پردازش داده (DPU) AMD Pensando
  • فناوری AMD Infinity Fabric
  • پشته نرم‌افزاری AMD ROCm

ای‌ام‌دی برای تقویت بیشتر کارایی سیستم‌های Helios خود در بارهای کاری هوش مصنوعی، با شرکت Cerebras شریک شده است و قصد دارد موتور مقیاس ویفر Cerebras را با سیستم‌های Helios خود برای استنتاج فوق‌العاده سریع یکپارچه کند.

برای کسانی که ممکن است مطلع نباشند، موتور مقیاس ویفر Cerebras تمام حافظه و توان محاسباتی یک سوپرکامپیوتر هوش مصنوعی را روی یک تکه سیلیکون غول‌پیکر و به‌هم‌پیوسته قرار می‌دهد که در آن صدها هزار هسته محاسباتی و ده‌ها گیگابایت حافظه SRAM به طور یکپارچه متصل می‌شوند و به داده‌ها اجازه می‌دهند بدون برخورد به گلوگاه‌های شبکه خارجی به طور کارآمد حرکت کنند.

اساساً، موتور Cerebras می‌تواند مدلی با اندازه متوسط، یا بخش‌های بزرگی از یک مدل بزرگ، را در بخش واحدی از حافظه SRAM خود جای دهد. همچنین، همه‌کاره بودن رویکرد Cerebras امکان اجرای امور آموزش و استنتاج را فراهم می‌کند.

بر اساس نقشه راه در نظر گرفته شده توسط AMD، سیستم Helios یک موتور توان عملیاتی مقیاس‌پذیر با عملکرد بالا ارائه خواهد داد، درحالی‌که فناوری Cerebras استنتاج و تولید توکن با تأخیر فوق‌العاده پایین و فوق‌العاده سریع را فراهم می‌کند. انتظار می‌رود این دو موتور محاسباتی در کنار هم در هر ثانیه تا ۵ برابر توکن بیشتر به ازای هر وات ارائه دهند.

پژوهشگر OpenAI سیستم‌های هوش مصنوعی Cerebras را شگفت‌انگیز توصیف کرد
READ  AMD در نمایشگاه CES دست پر ظاهر می‌شود؛ نسل بعدی پردازنده‌های رایزن Zen 4
AMD Helios

«جفری وانگ» (Jeffrey Wang)، پژوهشگر OpenAI، فاش می‌کند مدل‌های داخلی که روی تراشه‌های Cerebras اجرا می‌شوند به قدری سریع هستند که وظایف پیش از اینکه او حتی فرصتی برای تغییر زمینه (Context-Switch) پیدا کند به پایان می‌رسند و این موضوع بهره‌وری او را افزایش می‌دهد. او توضیح داد:

«در داخل سازمان ما برخی مدل‌های OpenAI روی تراشه‌های Cerebras اجرا می‌شوند. این تراشه‌ها شگفت‌انگیز هستند زیرا قدرت استنتاج بسیار سریعی دارند.»

وانگ در ادامه اعلام کرد:

«و اهمیت این موضوع برای من در کارهای روزمره این است: درحالی‌که پیش از این ممکن بود مجبور باشم چند دقیقه برای اتمام یک کار صبر کنم، اکنون کار پیش از اینکه حتی فرصتی برای تغییر زمینه پیدا کنم برای من به پایان می‌رسد. این موضوع بهره‌وری مرا به شدت افزایش می‌دهد.»

مدل‌های هوش مصنوعی معمولاً زمانی که از یک وظیفه به وظیفه دیگر می‌پرند، تغییر زمینه می‌دهند. این اتفاق ممکن است در تنظیمات چندعاملی (Multi-agentic) که در آن مدل باید مجموعه‌ای از وظایف متنوع را انجام دهد، یا در مدل‌های ترکیب متخصصان (MoE) رخ دهد که در آن شبکه‌های عصبی فرعی مختلف در انجام یک وظیفه خاص تخصص دارند.

این واقعیت که سیستم‌های Cerebras مهندسان OpenAI را تحت تأثیر قرار داده، نشان می‌دهد که سیستم‌های رک‌اسکیل Helios شرکت AMD که با موتورهای مقیاس ویفر یکپارچه شده‌اند، احتمالاً پس از عرضه با استقبال بسیار خوبی مواجه خواهند شد.

این موضوع زمانی اهمیت بیشتری پیدا می‌کند که بدانید هزینه‌های استنتاج اکنون بزرگ‌ترین تعیین‌کننده سودآوری دیتاسنترها هستند.

نویسنده

این مقاله را دوست داشتید؟

مقالاتی که «نباید» از دست بدهید!

دیدگاه‌ها و پرسش‌و‌پاسخ

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *