مقدمه
پیشنهاد میشود قبل از خواندن این مقاله، مقاله کلانداده را مطالعه کنید.
فایلسیستم توزیعشده چیست؟
قبل از تعریف فایلسیستم توزیعشده باید تعریف فایلسیستم را بدانیم. فایلسیستم یک روش و ساختار دادهای است که سیستمعامل برای کنترل نحوه ذخیرهسازی و بازیابی فایلها استفاده میکند. برای مثال فایلسیستم NTFS برای سیستمعاملهای ویندوز، ext4 برای سیستمعاملهای لینوکسی و یا فایلسیستم سلسلهمراتبی HFS (Hierarchical File System) برای سیستمعاملهای Mac شرکت اپل (Apple) استفاده میشود.
فایلسیستم توزیعشده در کلانداده چیست؟
صرفنظر از اینکه سرور چقدر ظرفیت ذخیرهسازی یا قدرت محاسباتی دارد، کار با دادههای بزرگ و مدیریت آنها در یک سرور واحد چالشهایی را به همراه دارد. فرای یک سطح خاص، دیگر منطقی نیست که به افزایش مقیاس اقتصادی یا فنی (افزایش ظرفیت بیشتر به آن سرور) ادامه دهیم. در عوض، دادهها باید در چندین سرور در یک خوشه توزیع شوند تا از قدرت محاسباتی تجمیعشده در خوشه استفاده شود. یک سیستم فایل توزیعشده (DFS) به کسبوکارها امکان میدهد دسترسی به دادههای بزرگ را در چندین خوشه یا گره مدیریت کنند و به آنها اجازه میدهد تا دادههای بزرگ را بهسرعت بخوانند و چندین خواندن و نوشتن موازی انجام دهند.
استفاده از DFS کجا ضروری و مهم است؟
- در شرایطی که نیاز است سرعت بالای دسترسی به حجم بالایی از دادههای توزیعشده فراهم شود و آن دادهها مانند دادههای محلی کاربر به نظر برسند (Transparent Local Access).
- در حالتی که کاربران باید از مکان فیزیکی دادهها اطلاعی نداشته باشند (Location Independence).
- مقیاسپذیری بالا با افزودن ماشینهای بیشتر: سیستمهای DFS میتوانند به خوشههای بسیار بزرگ با هزاران سرور مقیاس شوند.
- تحملپذیری خطا: در شرایطی که نیاز است سیستم در صورت بروز خطا برای مثال از کار افتادن برخی از سرورها نیز به عملکرد صحیح خود ادامه دهد. یک DFS مقاوم در برابر خطا میتواند با پخش کردن دادهها در چندین ماشین، چنین خرابیهایی را مدیریت کند.
بخشهای اصلی فایلسیستم توزیعشده کداماند؟
فضای نام (Namespace) چیست؟
فضای نام مجموعهای از نامها است که برای شناسایی و ارجاع به فایلهای ذخیرهشده استفاده میشود. فضای نام تضمین میکند که همه اعضای مجموعه دارای نام منحصربهفرد هستند تا بتوان آنها را بهراحتی شناسایی کرد. فضاهای نام بهصورت سلسلهمراتبی ساخته میشوند تا امکان استفاده مجدد از نامها در زمینههای مختلف را فراهم کنند. برای مثال، سیستم نامگذاری افراد را در نظر بگیرید که در آن هر فرد دارای یک نام خاص و همچنین نام خانوادگی مشترک با بستگان خود است. اگر نام کوچک اعضای خانواده فقط در هر خانواده منحصربهفرد باشد، آنگاه هر فرد را میتوان به طور منحصربهفرد با ترکیب نام و نام خانوادگی شناسایی کرد.

ساختار DFS
نمونههای فایلسیستم توزیعشده
نمونههای فایلسیستم توزیعشده
- Ceph: یک بستر ذخیرهسازی رایگان و منبعباز است که ذخیرهسازی اشیا، بلوک و فایل را بر پایه یک خوشه توزیعشده مشترک فراهم میکند.
- Gluster: نام این فایلسیستم منبعباز از ترکیب عبارات GNU و Cluster به وجود آمده است.
- HDFS: مخفف Hadoop DFS است که بهعنوان یک سیستم فایل توزیعشده برای اجرا بر روی سختافزار معمولی بهمنظور پردازشهای کلانداده طراحی شده است. HDFS دسترسی با کارایی بالا به دادههای برنامه را فراهم کرده و همچنین دسترسی به دادههای فایلسیستم در Apache Hadoop را امکانپذیر میکند. بهصورت معمول از Hadoop و HDFS در موضوعات کلانداده استفاده میشود که در آن با استفاده از الگوریتم MapReduce اقدام به پردازش توزیعشده دادههای کلان میکنند.
- BeeGFS: یک فایلسیستم توزیعشده است که برای محاسبات با کارایی بالا توسعه یافته و بهینه شده است (برای مطالعه بیشتر درباره HPC کلیک کنید).
- Luster: نوعی فایلسیستم توزیعشده موازی است که اغلب برای محاسبات خوشهای در مقیاس بزرگ استفاده میشود.
NFS در DFS چیست؟
NFS مخفف Network File System است و نمونهای از فایلسیستم توزیعشده (DFS) است. یک پروتکل NFS بهعنوان معماری سرویسگیرنده سرور، به کاربران رایانه اجازه میدهد فایلهایی را که در راه دور قرار دارند، مشاهده، ذخیره و بهروزرسانی کنند. پروتکل NFS یکی از چندین استاندارد DFS برای ذخیرهسازی متصل به شبکه (NAS) است.


اگر بازخوردی درباره این مطلب دارید یا پرسشی دارید که بدون پاسخ مانده است، آن را از طریق بخش نظرات مطرح کنید.
ثبت نظر