امروزه از پردازندههای گرافیکی در بسیاری از کاربردهای علمی، شبیهسازی، پردازش دادههای حجیم، هوش مصنوعی، یادگیری عمیق و دیگر کاربردهای موازی برای افزایش سرعت پردازش استفاده میشود. در طول سالهای اخیر پیشرفتهای زیادی در معماری پردازندههای گرافیکی صورت گرفته و سازندگان این پردازندهها با ایجاد قابلیتها و امکانات جدید سعی در افزایش هر چه بیشتر سرعت کاربردها دارند. در این مقاله، پردازنده گرافیکی جدید شرکت NVIDIA با نام A100 معرفی و ویژگیهای اصلی آن توصیف شده است.
پردازنده گرافیکی A100
پردازنده گرافیکی A100 توسط شرکت انویدیا و براساس ریزمعماری جدید آمپر (NVIDIA Ampere GPU) که در سال 2020 معرفی شد و با بهرهگیری از فناوری ساخت 7 نانومتری TSMC ساخته شده است. تا پیش از آن، ریزمعماریهای متعددی توسط شرکت انویدیا ایجاد و معرفی شده بود که ولتا و تورینگ نمونههای اخیر آن بودند. سابق بر آن، پردازندههای گرافیکی V100 و Titan V با معماری ولتا و پردازندههای گرافیکی Quadro RTX 8000 و GeForce RTX 2080 Ti با معماری تورینگ ساخته شده بودند. پردازنده گرافیکی A100 از خانواده پردازندههای گرافیکی مورد استفاده در مراکز داده و در حال حاضر یکی از سریعترین شتابدهندههای موجود میباشد که کاربرد اصلی آن در تجزیه و تحلیل دادههای هوش مصنوعی، یادگیری عمیق و کاربردهای فوق سریع (High Performance Computing) است.
ویژگیهای اصلی پردازنده گرافیکی A100

دیاگرام نحوه اتصال پردازندههای گرافیکی A100

نمای کلی نحوه قرارگیری المانها بر روی پردازنده گرافیکی A100
کارایی پردازنده گرافیکی A100
شکل زیر کارایی این پردازنده را در اجرای محک BERT-LARGE نشان میدهد. این محک برای ارزیابی کارایی پردازندهها در کاربردهای یادگیری عمیق استفاد میشود. همانطور که در این شکل نشان داده شده، این پردازنده در حدود 250 برابر کارایی بیشتر نسبت به پردازنده مرکزی Intel Xeon 6240 ارائه کرده است.

کارایی پردازنده A100 در اجرای محک BERT-LARGE
شکل زیر نیز کارایی این پردازنده را در اجرای محک DLRM نشان میدهد که طبق نتایج، پردازنده گرافیکی A100 80GB کارایی سه برابری نسبت به A100 40GB داشته است. کارایی A100 40GB نیز در حدود 40 درصد بیشتر از V100 بوده است.

کارایی پردازنده A100 در اجرای محک DLRM
در نهایت، شکل زیر کارایی این پردازنده را در اجرای کاربردهای HPC نشان میدهد. همانطور که در این شکل مشخص است، پردازنده گرافیکی A100 به طور میانگین در اجرای مجموعهای منتخب از برنامههای HPC در حدود 11 برابر سریعتر از P100 و 7/2 برابر سریعتر از V100 بوده است.

کارایی پردازنده گرافیکی A100 در اجرای کاربردهای HPC
جمعبندی
در این مقاله پردازنده جدید شرکت انویدیا با نام A100 معرفی شد و ویژگیهای جدید آن به اختصار ذکر شد. این پردازنده گرافیکی با بهره بردن از آخرین فناوریهای حافظه، لینکهای ارتباطی، هستههای پردازشی و تکنیکهای کاهش سربار محاسبات به کارایی بسیار بالایی در کاربردهای HPC و یادگیری عمیق دست یافته است. در حال حاضر بسیاری از ابررایانههای برتر دنیا در حال استفاده از این پردازنده پیشرفته برای تسریع کاربردهای HPC و یادگیری عمیق هستند.
اگر بازخوردی درباره این مطلب دارید یا پرسشی دارید که بدون پاسخ مانده است، آن را از طریق بخش نظرات مطرح کنید.
ثبت نظر