مطالب مرتبط: هارد دیسک‌های SAS، HDD VS SSD، رمزنگاری داده‌ها و هاردها یک شمشیر دولبه

در دنیای امروز، اطلاعات به یکی از مهم‌ترین دارایی‌های هر سازمان، شرکت و حتی کاربران عادی تبدیل شده است. اگر در گذشته ارزش یک کسب‌وکار با ساختمان‌ها، تجهیزات، ماشین‌آلات یا سرمایه مالی آن سنجیده می‌شد، امروزه بخش عمده‌ای از ارزش واقعی سازمان‌ها در داده‌هایی نهفته است که روی سرورها و سامانه‌های ذخیره‌سازی نگهداری می‌شوند.اطلاعات مشتریان، سوابق مالی، پرونده‌های پزشکی، اطلاعات پروژه‌ها، اسناد حقوقی، پایگاه‌های داده، ایمیل‌ها، فایل‌های چندرسانه‌ای و ماشین‌های مجازی تنها بخشی از داده‌هایی هستند که هر روز در مراکز داده سراسر جهان ایجاد، پردازش و ذخیره می‌شوند. از دست رفتن این اطلاعات می‌تواند موجب توقف فعالیت سازمان، خسارت‌های مالی سنگین، کاهش اعتماد مشتریان و حتی مشکلات حقوقی شود.به همین دلیل، طراحی صحیح زیرساخت ذخیره‌سازی اطلاعات دیگر یک انتخاب نیست، بلکه ضرورتی اجتناب‌ناپذیر برای هر سازمان است. شناخت انواع سرورها، فناوری‌های ذخیره‌سازی، روش‌های افزایش قابلیت اطمینان، معماری RAID، سیستم‌های ذخیره‌سازی تحت شبکه و فناوری‌های مجازی‌سازی، اولین گام برای ایجاد زیرساختی پایدار، ایمن و قابل توسعه است.این مقاله با هدف ارائه یک مرجع جامع و کاربردی، مفاهیم پایه و پیشرفته مرتبط با زیرساخت ذخیره‌سازی اطلاعات را بررسی می‌کند. در ادامه با انواع سرورها، فناوری‌های HDD و SSD، رابط‌های SAS، SATA و NVMe، سطوح مختلف RAID، معماری‌های DAS، NAS و SAN، فایل‌سیستم‌های رایج و نقش مجازی‌سازی در مراکز داده مدرن آشنا خواهید شد.

اهمیت اطلاعات در عصر دیجیتال

اطلاعات؛ سرمایه‌ای ارزشمندتر از تجهیزات

در اقتصاد دیجیتال، داده‌ها به «نفت قرن بیست و یکم» تشبیه می‌شوند؛ با این تفاوت که برخلاف نفت، ارزش اطلاعات با استفاده و تحلیل صحیح افزایش می‌یابد. بسیاری از شرکت‌های بزرگ جهان بخش عمده ارزش خود را نه از دارایی‌های فیزیکی، بلکه از اطلاعات و دانش سازمانی به دست آورده‌اند. شرکت‌های فعال در تجارت الکترونیک، بانکداری، خدمات درمانی، حمل‌ونقل، آموزش، صنایع تولیدی و حتی کسب‌وکارهای کوچک، برای ادامه فعالیت خود به اطلاعات وابسته هستند.

برای مثال، یک فروشگاه اینترنتی ممکن است هزاران سفارش، اطلاعات پرداخت، موجودی کالا و سوابق مشتریان را روی سرورهای خود نگهداری کند. حذف یا تخریب این اطلاعات می‌تواند کل فرآیند فروش را متوقف کند. به همین ترتیب، بیمارستان‌ها برای دسترسی به پرونده‌های پزشکی، بانک‌ها برای انجام تراکنش‌های مالی و کارخانه‌ها برای کنترل خطوط تولید به داده‌های ذخیره‌شده در سرورها متکی هستند.

بنابراین، ارزش واقعی بسیاری از سازمان‌ها در اطلاعاتی نهفته است که در سامانه‌های ذخیره‌سازی آن‌ها قرار دارد.

رشد انفجاری حجم داده‌ها

با گسترش اینترنت، شبکه‌های اجتماعی، رایانش ابری، اینترنت اشیا (IoT)، هوش مصنوعی، دوربین‌های نظارتی با کیفیت بالا و سامانه‌های تحلیلی، حجم اطلاعات تولیدشده در جهان با سرعتی بی‌سابقه در حال افزایش است.

امروزه سازمان‌ها با انواع مختلفی از داده‌ها سروکار دارند، از جمله:

  • داده‌های ساخت‌یافته مانند پایگاه‌های داده رابطه‌ای
  • داده‌های نیمه‌ساخت‌یافته مانند فایل‌های JSON و XML
  • داده‌های بدون ساختار مانند تصاویر، ویدئوها، فایل‌های صوتی و اسناد متنی
  • داده‌های لحظه‌ای حاصل از حسگرها و تجهیزات صنعتی
  • فایل‌های ماشین‌های مجازی و کانتینرها
  • نسخه‌های پشتیبان و آرشیوهای بلندمدت

این رشد مداوم باعث شده است که طراحی زیرساخت ذخیره‌سازی، بیش از هر زمان دیگری اهمیت پیدا کند.

هزینه واقعی از دست رفتن اطلاعات

بسیاری از افراد تصور می‌کنند که هزینه از دست رفتن اطلاعات تنها به ارزش فایل‌های حذف‌شده محدود می‌شود، اما واقعیت بسیار گسترده‌تر است. هنگامی که اطلاعات یک سازمان از بین می‌رود، معمولاً مجموعه‌ای از خسارت‌های مستقیم و غیرمستقیم ایجاد می‌شود.

این خسارت‌ها می‌توانند شامل موارد زیر باشند:

  • توقف فعالیت کسب‌وکار
  • کاهش بهره‌وری کارکنان
  • از دست رفتن اعتماد مشتریان
  • هزینه‌های بازیابی اطلاعات
  • جریمه‌های ناشی از عدم رعایت مقررات
  • آسیب به اعتبار برند
  • از دست رفتن فرصت‌های تجاری
  • تأخیر در ارائه خدمات

در برخی صنایع مانند بانکداری، حمل‌ونقل هوایی، مراکز درمانی و تجارت الکترونیک، حتی چند دقیقه از دسترس خارج شدن سامانه‌ها نیز می‌تواند خسارت‌های قابل توجهی ایجاد کند.

سه اصل بنیادین امنیت اطلاعات

تمام استانداردهای امنیت اطلاعات، صرف‌نظر از نوع فناوری مورد استفاده، بر سه اصل اساسی استوار هستند که به «مثلث امنیت اطلاعات» یا CIA Triad معروف است.

۱. محرمانگی (Confidentiality)

محرمانگی به این معناست که اطلاعات فقط باید در اختیار افراد یا سامانه‌هایی قرار گیرد که مجوز دسترسی دارند.

برای تحقق این هدف از روش‌هایی مانند:

  • کنترل دسترسی کاربران
  • رمزنگاری اطلاعات
  • احراز هویت چندمرحله‌ای
  • مدیریت سطح دسترسی
  • ثبت و پایش فعالیت کاربران

استفاده می‌شود.

۲. یکپارچگی (Integrity)

یکپارچگی به معنای حفظ صحت و کامل بودن اطلاعات است. داده‌ها نباید به‌صورت غیرمجاز تغییر کنند، حذف شوند یا دچار فساد شوند.

برای حفظ یکپارچگی اطلاعات از فناوری‌هایی مانند:

  • Checksum
  • Hash
  • ECC Memory
  • Journal File System
  • RAID
  • Snapshot

استفاده می‌شود.

۳. دسترس‌پذیری (Availability)

دسترس‌پذیری به این معناست که اطلاعات و خدمات در هر زمان که کاربران مجاز به آن نیاز داشته باشند، قابل استفاده باشند.

برای افزایش دسترس‌پذیری معمولاً از فناوری‌هایی مانند:

  • RAID
  • منبع تغذیه افزونه (Redundant Power Supply)
  • شبکه‌های افزونه
  • کلاسترهای High Availability
  • Load Balancer
  • مراکز داده پشتیبان
  • سیستم‌های برق اضطراری (UPS)
  • سامانه‌های خنک‌کننده افزونه

استفاده می‌شود.

چرخه عمر اطلاعات (Data Lifecycle)

اطلاعات از لحظه ایجاد تا زمان حذف نهایی، مراحل مختلفی را طی می‌کنند که به آن چرخه عمر اطلاعات گفته می‌شود. شناخت این چرخه به سازمان‌ها کمک می‌کند تا برای هر مرحله، راهکار مناسب ذخیره‌سازی، حفاظت و مدیریت را انتخاب کنند.

مراحل اصلی چرخه عمر اطلاعات عبارت‌اند از:

  1. ایجاد (Create): تولید داده توسط کاربران، نرم‌افزارها یا تجهیزات.
  2. ذخیره‌سازی (Store): نگهداری اطلاعات روی رسانه‌های ذخیره‌سازی مانند HDD، SSD یا سامانه‌های ابری.
  3. استفاده (Use): دسترسی کاربران یا نرم‌افزارها به اطلاعات.
  4. اشتراک‌گذاری (Share): انتقال اطلاعات میان کاربران یا سامانه‌ها.
  5. آرشیو (Archive): نگهداری بلندمدت اطلاعاتی که کمتر مورد استفاده قرار می‌گیرند.
  6. حذف یا امحا (Dispose): حذف ایمن اطلاعات در پایان چرخه عمر.

طراحی زیرساخت ذخیره‌سازی باید تمام این مراحل را در نظر بگیرد تا ضمن حفظ امنیت، دسترسی و کارایی، هزینه‌های نگهداری نیز بهینه شود.

چرا شناخت زیرساخت ذخیره‌سازی اهمیت دارد؟

بسیاری از مشکلاتی که در مراکز داده مشاهده می‌شود، نه به دلیل خرابی تجهیزات، بلکه به دلیل طراحی نامناسب زیرساخت است. انتخاب نادرست نوع سرور، استفاده از آرایش RAID نامناسب، عدم توجه به رشد آینده سازمان یا انتخاب رسانه ذخیره‌سازی نامتناسب با نوع بار کاری، می‌تواند موجب کاهش کارایی، افزایش هزینه‌ها و حتی از دست رفتن اطلاعات شود.

به همین دلیل، شناخت مفاهیم پایه‌ای مانند انواع سرورها، رسانه‌های ذخیره‌سازی، رابط‌های انتقال داده، معماری RAID، سیستم‌های NAS و SAN و فناوری‌های مجازی‌سازی، پیش‌نیاز طراحی یک زیرساخت مطمئن و پایدار است.

در فصل‌های بعدی، هر یک از این فناوری‌ها به‌صورت گام‌به‌گام، از مفاهیم پایه تا جزئیات فنی، بررسی خواهند شد تا خواننده بتواند درک جامعی از معماری مراکز داده و زیرساخت‌های ذخیره‌سازی مدرن به دست آورد.

آشنایی با انواع سرورها

سرور چیست؟

واژه Server در ساده‌ترین تعریف به معنای «ارائه‌دهنده خدمت» است. هر سیستمی که منابع، اطلاعات یا خدماتی را در اختیار سایر دستگاه‌های موجود در شبکه قرار دهد، یک سرور محسوب می‌شود. این خدمات می‌تواند شامل ذخیره فایل، میزبانی وب‌سایت، اجرای نرم‌افزارهای سازمانی، مدیریت ایمیل، نگهداری پایگاه‌های داده یا اجرای ماشین‌های مجازی باشد.

اگر رایانه شخصی را به یک خودروی سواری تشبیه کنیم، سرور را می‌توان به یک کامیون سنگین یا یک نیروگاه کوچک تشبیه کرد؛ سیستمی که برای کار مداوم، تحمل بارهای پردازشی بالا و ارائه خدمات بدون وقفه طراحی شده است.

برخلاف رایانه‌های شخصی که معمولاً روزانه چند ساعت روشن هستند، بسیاری از سرورها به‌صورت ۲۴ ساعت شبانه‌روز و هفت روز هفته (24×7×365) فعالیت می‌کنند. به همین دلیل، قطعات داخلی آن‌ها از نظر کیفیت، دوام و قابلیت اطمینان تفاوت‌های قابل‌توجهی با رایانه‌های معمولی دارند.

تفاوت سرور و رایانه شخصی (PC)

در نگاه اول، سرور و رایانه شخصی شباهت زیادی به یکدیگر دارند. هر دو دارای پردازنده، حافظه، مادربرد، فضای ذخیره‌سازی و منبع تغذیه هستند؛ اما فلسفه طراحی آن‌ها کاملاً متفاوت است.

ویژگیرایانه شخصیسرور
هدف اصلیاستفاده فردیارائه خدمات به کاربران متعدد
زمان کارچند ساعت در روز24 ساعته و مداوم
پردازندهمعمولاً یک CPUیک یا چند CPU سازمانی
حافظهRAM معمولیECC RAM
ذخیره‌سازیHDD یا SSD معمولیHDD/SSD Enterprise
RAIDمعمولاً نداردتقریباً همیشه وجود دارد
منبع تغذیهتک پاورRedundant Power Supply
مدیریت از راه دورمحدودiLO، iDRAC، XClarity و مشابه
قابلیت توسعهمحدودبسیار زیاد

این تفاوت‌ها باعث می‌شوند سرورها بتوانند حجم بالایی از پردازش و ذخیره‌سازی را با پایداری بیشتری انجام دهند.

ویژگی‌های یک سرور حرفه‌ای

سرورهای سازمانی معمولاً دارای ویژگی‌های زیر هستند:

  • قابلیت کارکرد مداوم بدون خاموشی
  • استفاده از حافظه ECC برای کاهش خطا
  • وجود چندین هارددیسک یا SSD
  • پشتیبانی از RAID
  • منابع تغذیه افزونه
  • سیستم خنک‌کننده پیشرفته
  • امکان مدیریت از راه دور
  • قابلیت ارتقای پردازنده، حافظه و فضای ذخیره‌سازی
  • طراحی مناسب برای نصب در رک‌های مراکز داده

این ویژگی‌ها باعث می‌شوند احتمال توقف سرویس‌ها به حداقل برسد.

دسته‌بندی سرورها بر اساس شکل ظاهری (Form Factor)

۱. Tower Server

سرورهای Tower از نظر ظاهری شباهت زیادی به کیس‌های بزرگ رایانه دارند. این نوع سرورها معمولاً برای شرکت‌های کوچک، دفاتر اداری و سازمان‌هایی با تعداد کاربران محدود مناسب هستند.

مزایا

  • قیمت مناسب
  • نصب آسان
  • صدای کمتر
  • عدم نیاز به رک

معایب

  • اشغال فضای بیشتر
  • توسعه محدودتر نسبت به سرورهای رکمونت
  • مدیریت سخت‌تر در مقیاس بزرگ

۲. Rack Server

رایج‌ترین نوع سرور در مراکز داده، سرورهای Rack Mount هستند. این سرورها داخل رک‌های استاندارد ۱۹ اینچی نصب می‌شوند و بر اساس ارتفاع با واحد U (Unit) اندازه‌گیری می‌شوند.

هر U معادل ۱٫۷۵ اینچ (۴٫۴۵ سانتی‌متر) ارتفاع است.

متداول‌ترین اندازه‌ها عبارت‌اند از:

  • 1U
  • 2U
  • 4U

هرچه ارتفاع بیشتر باشد، فضای بیشتری برای پردازنده، حافظه، هارددیسک و کارت‌های توسعه فراهم می‌شود.

مزایا

  • استفاده بهینه از فضای رک
  • مدیریت آسان
  • تهویه مناسب
  • توسعه‌پذیری بالا
  • مناسب برای مراکز داده

معایب

  • نیاز به رک
  • صدای بیشتر
  • هزینه اولیه بالاتر

۳. Blade Server

Blade Serverها برای مراکز داده بزرگ طراحی شده‌اند.

در این معماری، چندین سرور باریک (Blade) داخل یک شاسی مشترک قرار می‌گیرند.

تمام Bladeها از منابع مشترکی مانند:

  • برق
  • شبکه
  • سیستم خنک‌کننده
  • مدیریت مرکزی

استفاده می‌کنند.

مزایا

  • تراکم بسیار بالا
  • مصرف انرژی کمتر
  • کابل‌کشی منظم
  • مدیریت متمرکز

معایب

  • هزینه اولیه زیاد
  • وابستگی به شاسی
  • مناسب نبودن برای سازمان‌های کوچک

۴. Hyper-Converged Infrastructure (HCI)

در سال‌های اخیر، زیرساخت‌های Hyper-Converged محبوبیت زیادی پیدا کرده‌اند.

در این معماری، سرور، فضای ذخیره‌سازی و مجازی‌سازی در یک پلتفرم یکپارچه ادغام می‌شوند.

نمونه‌هایی از این راهکارها عبارت‌اند از:

  • VMware vSAN
  • Nutanix
  • Azure Stack HCI

مزیت اصلی HCI، سادگی مدیریت و مقیاس‌پذیری بالاست.

۵. Edge Server

با گسترش اینترنت اشیا و نیاز به پردازش داده‌ها در نزدیک‌ترین نقطه به محل تولید، Edge Serverها توسعه یافته‌اند.

این سرورها معمولاً در مکان‌هایی مانند:

  • کارخانه‌ها
  • ایستگاه‌های مخابراتی
  • فروشگاه‌های زنجیره‌ای
  • سیستم‌های حمل‌ونقل
  • تجهیزات صنعتی

نصب می‌شوند تا داده‌ها را پیش از ارسال به مرکز داده پردازش کنند.

۶. Cloud Server

سرورهای ابری در حقیقت ماشین‌های مجازی هستند که روی زیرساخت ارائه‌دهندگان خدمات ابری اجرا می‌شوند.

کاربر بدون خرید سخت‌افزار فیزیکی، می‌تواند منابع پردازشی، حافظه و فضای ذخیره‌سازی مورد نیاز خود را اجاره کند.

مزایای Cloud Server عبارت‌اند از:

  • مقیاس‌پذیری سریع
  • کاهش هزینه سرمایه‌گذاری اولیه
  • دسترسی آسان
  • مدیریت ساده‌تر
  • پرداخت بر اساس میزان مصرف

البته انتخاب بین سرور فیزیکی و سرور ابری به نیازهای امنیتی، عملکردی و بودجه هر سازمان بستگی دارد.

انواع سرورها بر اساس نوع خدمات

سرورها را می‌توان بر اساس وظیفه‌ای که انجام می‌دهند نیز دسته‌بندی کرد.

File Server

برای ذخیره و اشتراک‌گذاری فایل‌ها در شبکه استفاده می‌شود و معمولاً از پروتکل‌هایی مانند SMB یا NFS بهره می‌برد.

Database Server

وظیفه اجرای سامانه‌های مدیریت پایگاه داده مانند Microsoft SQL Server، PostgreSQL، MySQL یا Oracle را بر عهده دارد. این نوع سرورها به حافظه و فضای ذخیره‌سازی پرسرعت نیاز دارند.

Web Server

وب‌سایت‌ها و برنامه‌های تحت وب را میزبانی می‌کند. نرم‌افزارهایی مانند Apache، Nginx و Microsoft IIS از رایج‌ترین وب‌سرورها هستند.

Mail Server

ارسال، دریافت و ذخیره ایمیل‌های سازمان را مدیریت می‌کند و معمولاً از پروتکل‌های SMTP، IMAP و POP3 استفاده می‌کند.

Application Server

برنامه‌های سازمانی مانند ERP، CRM، سیستم‌های مالی و اتوماسیون اداری را اجرا می‌کند.

Virtualization Server

برای اجرای ماشین‌های مجازی طراحی شده است و معمولاً دارای تعداد زیادی هسته پردازشی، حافظه فراوان و ذخیره‌سازی پرسرعت است.

Backup Server

نسخه‌های پشتیبان اطلاعات را ذخیره و مدیریت می‌کند و یکی از مهم‌ترین اجزای زیرساخت حفاظت از داده‌ها به شمار می‌رود.

بازار سرورهای سازمانی در اختیار چند شرکت بزرگ قرار دارد که محصولات آن‌ها در مراکز داده سراسر جهان استفاده می‌شود. Supermicro ،Lenovo Cisco ،Dell Technologies و HPE (Hewlett Packard Enterprise) از جمله بزرگترین تولیدکنندگان سرور در دنیا هستند

روند تحول سرورها

در دو دهه گذشته، سرورها مسیر تکامل چشمگیری را طی کرده‌اند:

  • از سرورهای تک‌پردازنده به سامانه‌های چندسوکته
  • از هارددیسک‌های مکانیکی به SSDهای NVMe
  • از مراکز داده سنتی به زیرساخت‌های ابری و Hyper-Converged
  • از مدیریت محلی به مدیریت کاملاً از راه دور
  • از اجرای یک سیستم‌عامل روی هر سرور به اجرای ده‌ها یا حتی صدها ماشین مجازی روی یک سرور فیزیکی

این تحول باعث شده است که شناخت معماری داخلی سرورها اهمیت بیشتری پیدا کند؛ زیرا عملکرد و قابلیت اطمینان کل زیرساخت به هماهنگی صحیح اجزای سخت‌افزاری و نرم‌افزاری وابسته است.

معماری داخلی سرورها؛ شناخت اجزای اصلی قلب مراکز داده

نمای کلی معماری یک سرور

یک سرور سازمانی معمولاً از بخش‌های زیر تشکیل شده است:

  • مادربرد (Server Motherboard)
  • پردازنده یا پردازنده‌ها (CPU)
  • حافظه ECC (RAM)
  • چیپ‌ست (Chipset)
  • کنترلر RAID یا HBA
  • رسانه‌های ذخیره‌سازی (HDD / SSD / NVMe)
  • Backplane
  • منابع تغذیه افزونه (Redundant PSU)
  • سیستم خنک‌کننده
  • کارت‌های شبکه (NIC)
  • رابط مدیریت از راه دور (BMC)
  • اسلات‌های توسعه PCI Express

هر یک از این اجزا نقش مهمی در عملکرد و پایداری سرور دارند.

مادربرد سرور (Server Motherboard)

مادربرد ستون فقرات سرور است و تمام قطعات اصلی روی آن نصب می‌شوند. برخلاف مادربردهای رایانه‌های شخصی، مادربردهای سرور برای کارکرد مداوم، تحمل بارهای سنگین و پشتیبانی از چندین پردازنده و حجم زیادی از حافظه طراحی شده‌اند.

ویژگی‌های رایج مادربردهای سرور عبارت‌اند از:

  • پشتیبانی از یک، دو یا چند سوکت پردازنده
  • تعداد زیاد اسلات حافظه
  • مسیرهای PCIe بیشتر
  • مدار تغذیه پایدارتر
  • وجود تراشه مدیریت از راه دور (BMC)
  • قابلیت تشخیص و گزارش خطاهای سخت‌افزاری

در بسیاری از مدل‌ها، امکان تعویض برخی قطعات بدون خاموش کردن کامل سیستم نیز فراهم شده است.

پردازنده (CPU)

پردازنده مغز سرور است و مسئول اجرای تمام دستورالعمل‌ها و پردازش‌های سیستم محسوب می‌شود.

در محیط‌های سازمانی معمولاً از پردازنده‌های سری Intel Xeon یا AMD EPYC استفاده می‌شود. این پردازنده‌ها برای اجرای بارهای پردازشی سنگین، مجازی‌سازی، پایگاه‌های داده و محاسبات علمی طراحی شده‌اند.

تفاوت پردازنده سرور با پردازنده دسکتاپ

مهم‌ترین تفاوت‌ها عبارت‌اند از:

  • تعداد هسته‌های بیشتر
  • حافظه Cache بزرگ‌تر
  • پشتیبانی از حافظه ECC
  • قابلیت نصب چند پردازنده روی یک مادربرد
  • تعداد خطوط PCI Express بیشتر
  • پایداری بالاتر در بارهای کاری طولانی‌مدت

به‌عنوان مثال، یک پردازنده سرور ممکن است دارای ده‌ها هسته پردازشی و صدها مگابایت حافظه Cache باشد و بتواند هم‌زمان صدها ماشین مجازی یا هزاران درخواست کاربران را مدیریت کند.

تعداد هسته و رشته‌های پردازشی

در گذشته، افزایش فرکانس پردازنده مهم‌ترین عامل افزایش سرعت بود؛ اما امروزه بیشتر پیشرفت‌ها از طریق افزایش تعداد هسته‌ها و رشته‌های پردازشی حاصل می‌شود.

هر هسته می‌تواند بخشی از پردازش‌ها را به‌طور مستقل انجام دهد و در بسیاری از پردازنده‌ها، فناوری‌هایی مانند Hyper-Threading یا SMT نیز باعث می‌شوند هر هسته بتواند چند رشته پردازشی را به‌صورت هم‌زمان مدیریت کند.

این ویژگی به‌ویژه در محیط‌های مجازی‌سازی و پایگاه‌های داده اهمیت زیادی دارد.

حافظه اصلی (RAM)

حافظه RAM محل نگهداری موقت داده‌ها و برنامه‌هایی است که پردازنده در حال استفاده از آن‌هاست. هرچه ظرفیت و سرعت RAM بیشتر باشد، سرور می‌تواند حجم بیشتری از داده‌ها را بدون نیاز به مراجعه مکرر به دیسک‌ها پردازش کند.

در بسیاری از کاربردهای سازمانی، کمبود RAM باعث کاهش شدید کارایی می‌شود، حتی اگر پردازنده بسیار قدرتمند باشد.

حافظه ECC چیست؟

تقریباً تمام سرورهای حرفه‌ای از حافظه ECC (Error Correcting Code) استفاده می‌کنند.

این نوع حافظه قادر است خطاهای تک‌بیتی را به‌صورت خودکار تشخیص داده و اصلاح کند و خطاهای بزرگ‌تر را به سیستم گزارش دهد.

اهمیت این موضوع زمانی مشخص می‌شود که بدانیم حتی یک تغییر ناخواسته در یک بیت از اطلاعات می‌تواند باعث خرابی پایگاه داده، فایل‌های حساس یا ماشین‌های مجازی شود.

چرا ECC اهمیت دارد؟

منشأ خطاهای حافظه می‌تواند عوامل مختلفی باشد، از جمله:

  • نویز الکتریکی
  • نوسانات برق
  • افزایش دما
  • تابش پرتوهای کیهانی
  • فرسودگی تراشه‌ها

در رایانه‌های معمولی چنین خطاهایی معمولاً شناسایی نمی‌شوند، اما در سرورها که صحت اطلاعات اهمیت حیاتی دارد، ECC نقش مهمی در افزایش قابلیت اطمینان ایفا می‌کند.

چیپ‌ست (Chipset)

چیپ‌ست مجموعه‌ای از مدارهای الکترونیکی است که ارتباط میان پردازنده، حافظه، تجهیزات ذخیره‌سازی و سایر اجزای سیستم را مدیریت می‌کند.

اگرچه بسیاری از وظایف چیپ‌ست در پردازنده‌های جدید به خود CPU منتقل شده‌اند، اما همچنان نقش مهمی در مدیریت ارتباطات داخلی سرور دارد.

گذرگاه PCI Express

تقریباً تمام تجهیزات پرسرعت سرور از طریق گذرگاه PCI Express به مادربرد متصل می‌شوند.

از جمله:

  • کنترلر RAID
  • کارت شبکه 10GbE، 25GbE، 40GbE و 100GbE
  • SSDهای NVMe
  • کارت‌های Fibre Channel
  • شتاب‌دهنده‌های هوش مصنوعی (GPU)
  • کارت‌های FPGA

نسل‌های جدید PCIe پهنای باند بسیار بالایی را در اختیار تجهیزات قرار می‌دهند و نقش مهمی در عملکرد سرور دارند.

کنترلر RAID

یکی از مهم‌ترین قطعات هر سرور سازمانی، کنترلر RAID است.

این کنترلر وظایف زیر را بر عهده دارد:

  • مدیریت آرایه‌های RAID
  • محاسبه Parity
  • مدیریت Cache
  • بازسازی آرایه‌ها (Rebuild)
  • پایش سلامت دیسک‌ها
  • گزارش خطاها

کنترلرهای حرفه‌ای معمولاً دارای پردازنده اختصاصی و حافظه Cache هستند تا این عملیات بدون تحمیل بار اضافی به پردازنده اصلی انجام شود.

HBA چیست؟

در برخی زیرساخت‌ها به‌جای کنترلر RAID از Host Bus Adapter (HBA) استفاده می‌شود.

HBA هیچ عملیات RAID انجام نمی‌دهد و فقط ارتباط مستقیم میان سیستم‌عامل و تجهیزات ذخیره‌سازی را برقرار می‌کند.

این روش در فایل‌سیستم‌هایی مانند ZFS یا برخی سامانه‌های ذخیره‌سازی نرم‌افزاری ترجیح داده می‌شود، زیرا مدیریت افزونگی را خود فایل‌سیستم انجام می‌دهد.

Backplane

در بسیاری از سرورهای رکمونت، دیسک‌ها مستقیماً به مادربرد متصل نمی‌شوند، بلکه از طریق قطعه‌ای به نام Backplane ارتباط برقرار می‌کنند.

Backplane چند وظیفه مهم دارد:

  • انتقال برق به دیسک‌ها
  • انتقال داده
  • پشتیبانی از Hot Swap
  • مدیریت LEDهای وضعیت هر دیسک

به کمک Backplane می‌توان بسیاری از هارددیسک‌ها یا SSDها را بدون خاموش کردن سرور تعویض کرد.

Hot Swap

یکی از قابلیت‌های مهم سرورهای سازمانی، Hot Swap است.

این فناوری اجازه می‌دهد قطعاتی مانند هارددیسک، SSD، منبع تغذیه یا برخی فن‌ها بدون خاموش کردن سرور تعویض شوند.

این ویژگی برای مراکز داده‌ای که باید به‌صورت ۲۴ ساعته فعال باشند، اهمیت بسیار زیادی دارد و زمان ازکارافتادگی را به حداقل می‌رساند.

منابع تغذیه افزونه (Redundant Power Supply)

سرورهای حرفه‌ای معمولاً دارای دو یا چند منبع تغذیه هستند.

در این حالت، اگر یکی از پاورها دچار مشکل شود، پاور دیگر بدون وقفه برق موردنیاز سیستم را تأمین می‌کند و کاربران هیچ اختلالی را احساس نخواهند کرد.

در بسیاری از مراکز داده، هر پاور به یک مسیر برق مستقل متصل می‌شود تا حتی خرابی یک تابلو برق نیز باعث خاموش شدن سرور نشود.

سیستم خنک‌ کننده

گرما یکی از مهم‌ترین دشمنان تجهیزات الکترونیکی است. پردازنده‌ها، حافظه‌ها، کنترلرهای RAID و SSDهای NVMe هنگام کار گرمای قابل توجهی تولید می‌کنند.

به همین دلیل، سرورها از فن‌های پرقدرت با قابلیت کنترل هوشمند سرعت استفاده می‌کنند تا دمای قطعات در محدوده ایمن باقی بماند.

در مراکز داده نیز سیستم‌های تهویه و خنک‌کننده صنعتی نقش مهمی در افزایش عمر تجهیزات دارند.

کارت شبکه (NIC)

کارت شبکه رابط ارتباطی سرور با سایر تجهیزات شبکه است.

سرورهای امروزی ممکن است دارای یک یا چند کارت شبکه با سرعت‌های مختلف باشند، از جمله:

  • 1GbE
  • 10GbE
  • 25GbE
  • 40GbE
  • 100GbE

در محیط‌های پرترافیک، استفاده از چند کارت شبکه به‌صورت هم‌زمان باعث افزایش پهنای باند و افزونگی ارتباطات می‌شود.

BMC؛ مدیریت سرور از راه دور

یکی از ویژگی‌های مهم سرورهای سازمانی وجود تراشه Baseboard Management Controller (BMC) است.

این تراشه امکان مدیریت کامل سرور را حتی زمانی که سیستم‌عامل خاموش یا دچار مشکل شده است، فراهم می‌کند.

از طریق BMC می‌توان:

  • سرور را روشن یا خاموش کرد.
  • وضعیت سلامت قطعات را مشاهده کرد.
  • دمای سیستم را بررسی کرد.
  • گزارش خطاها را دریافت کرد.
  • سیستم‌عامل را از راه دور نصب کرد.
  • کنسول گرافیکی سرور را مشاهده کرد.

شرکت‌های مختلف نام‌های اختصاصی برای این فناوری دارند؛ برای مثال، HPE آن را iLO و Dell آن را iDRAC می‌نامد.

اهمیت هماهنگی اجزای سرور

قدرت یک سرور تنها به پردازنده یا حافظه آن وابسته نیست. اگر یکی از اجزای اصلی، مانند کنترلر RAID، سیستم خنک‌کننده یا منابع تغذیه، عملکرد مناسبی نداشته باشد، کل زیرساخت تحت تأثیر قرار می‌گیرد.

به همین دلیل، طراحی سرورهای سازمانی بر پایه افزونگی (Redundancy)، قابلیت اطمینان (Reliability) و دسترس‌پذیری (Availability) انجام می‌شود تا حتی در صورت خرابی برخی قطعات، خدمات بدون وقفه ادامه پیدا کند.

ذخیره‌سازی اطلاعات در سرورها؛ HDD و SSD

ذخیره‌سازی اطلاعات یکی از مهم‌ترین بخش‌های هر زیرساخت سروری است. حتی قدرتمندترین پردازنده‌ها و بیشترین مقدار حافظه RAM، بدون یک سیستم ذخیره‌سازی مناسب نمی‌توانند عملکرد مطلوبی ارائه دهند. سرعت اجرای برنامه‌ها، زمان پاسخ‌گویی پایگاه‌های داده، سرعت بارگذاری ماشین‌های مجازی و حتی تجربه کاربران نهایی، ارتباط مستقیمی با نوع و معماری فضای ذخیره‌سازی دارد.

در گذشته، هارددیسک‌های مکانیکی (HDD) تقریباً تنها گزینه موجود برای ذخیره اطلاعات بودند؛ اما با پیشرفت فناوری، SSDها، حافظه‌های NVMe و سامانه‌های ذخیره‌سازی پرسرعت وارد مراکز داده شدند و تحول بزرگی در معماری ذخیره‌سازی ایجاد کردند.

امروزه انتخاب رسانه ذخیره‌سازی دیگر فقط بر اساس ظرفیت انجام نمی‌شود، بلکه عواملی مانند:

  • سرعت خواندن و نوشتن
  • تعداد عملیات ورودی/خروجی در ثانیه (IOPS)
  • تأخیر (Latency)
  • طول عمر
  • قابلیت اطمینان
  • مصرف انرژی
  • هزینه هر گیگابایت

نیز اهمیت زیادی دارند.

ساختار کلی ذخیره‌سازی اطلاعات در سرورها

برای درک بهتر فناوری‌های ذخیره‌سازی، ابتدا باید مسیر انتقال اطلاعات را بشناسیم.

هنگامی که یک نرم‌افزار روی سرور درخواست خواندن یا نوشتن اطلاعات را ارسال می‌کند، داده از مسیر زیر عبور می‌کند:

Application → Operating System → File System → Storage Controller → Interface → Storage Device

برای مثال، هنگامی که یک پایگاه داده اطلاعاتی را ذخیره می‌کند:

  1. برنامه درخواست نوشتن اطلاعات را ارسال می‌کند.
  2. سیستم‌عامل درخواست را مدیریت می‌کند.
  3. فایل‌سیستم محل ذخیره داده را مشخص می‌کند.
  4. کنترلر ذخیره‌سازی عملیات را به دیسک ارسال می‌کند.
  5. دیسک اطلاعات را روی رسانه فیزیکی ذخیره می‌کند.

هر مرحله از این مسیر می‌تواند روی سرعت و پایداری سیستم تأثیرگذار باشد.

معیارهای مهم در انتخاب ذخیره‌سازی سرور

ظرفیت (Capacity)

ظرفیت نشان‌دهنده مقدار اطلاعاتی است که یک رسانه می‌تواند ذخیره کند.

واحدهای رایج:

  • گیگابایت (GB)
  • ترابایت (TB)
  • پتابایت (PB)

برای مثال:

  • فایل سرورهای سازمانی معمولاً به ظرفیت بالا نیاز دارند.
  • پایگاه‌های داده بیشتر به سرعت و IOPS اهمیت می‌دهند.

سرعت انتقال داده (Throughput)

Throughput نشان می‌دهد چه مقدار داده در یک بازه زمانی مشخص منتقل می‌شود.

معمولاً با واحد:

  • MB/s
  • GB/s

اندازه‌ گیری می‌شود.

برای مثال، یک هارددیسک معمولی ممکن است سرعتی حدود چند صد مگابایت بر ثانیه داشته باشد، در حالی که SSDهای NVMe حرفه‌ای می‌توانند چندین گیگابایت بر ثانیه اطلاعات منتقل کنند.

IOPS چیست؟

(Input/Output Operations Per Second) : IOPS به معنی تعداد عملیات ورودی و خروجی در هر ثانیه است.

این معیار برای کاربردهایی مانند:

  • دیتابیس
  • مجازی‌سازی
  • سیستم‌های مالی
  • سامانه‌های تراکنشی

اهمیت بسیار بیشتری از سرعت انتقال متوالی دارد.

برای مثال:

یک هارد HDD ممکن است سرعت انتقال مناسبی داشته باشد، اما هنگام انجام هزاران درخواست کوچک هم‌زمان، به دلیل حرکت مکانیکی هد عملکرد آن کاهش پیدا می‌کند.

Latency یا تأخیر

Latency مدت زمانی است که طول می‌کشد تا یک درخواست خواندن یا نوشتن پاسخ داده شود.

تأخیر کمتر به معنی پاسخ‌گویی سریع‌تر سیستم است.

مقایسه تقریبی:

  • HDD: چند میلی‌ثانیه
  • SATA SSD: کمتر از یک میلی‌ثانیه
  • NVMe SSD: چند ده میکروثانیه

در برنامه‌هایی مانند پایگاه داده‌های بزرگ، حتی کاهش چند میلی‌ثانیه‌ای تأخیر می‌تواند تأثیر چشمگیری داشته باشد.

مزایای HDD در سرورها

با وجود ظهور SSD، هارددیسک همچنان جایگاه مهمی در مراکز داده دارد.

مزایا:

ظرفیت بسیار بالا

هاردهای سازمانی می‌توانند ظرفیت‌های بسیار زیادی ارائه دهند و برای ذخیره آرشیو، Backup و داده‌های حجیم مناسب هستند.

هزینه کمتر

هزینه هر گیگابایت در HDD معمولاً بسیار پایین‌تر از SSD است.

مناسب برای ذخیره‌سازی طولانی‌مدت

برای اطلاعاتی که نیاز به سرعت بسیار بالا ندارند، HDD گزینه اقتصادی‌تری است.

معایب HDD

قطعات مکانیکی

وجود قطعات متحرک باعث می‌شود HDD در برابر:

  • ضربه
  • لرزش
  • شوک
  • فرسودگی مکانیکی

آسیب‌پذیرتر باشد.

سرعت محدود

حرکت هد و چرخش پلاتر باعث ایجاد تأخیر می‌شود.

مصرف انرژی بیشتر

در مقایسه با SSD، HDD انرژی بیشتری مصرف می‌کند.

هاردهای Enterprise HDD

هاردهای مخصوص سرور با هاردهای دسکتاپ تفاوت زیادی دارند.

ویژگی‌های HDD سرورها :

  • طراحی برای کارکرد 24 ساعته و 7 روز هفته
  • تحمل بار کاری بیشتر
  • Firmware اختصاصی
  • سنسورهای پیشرفته‌تر
  • نرخ خطای پایین‌تر
  • پشتیبانی بهتر از RAID

SSD در سرورها

SSD یا Solid State Drive نسل جدیدی از تجهیزات ذخیره‌سازی است که برخلاف HDD هیچ قطعه مکانیکی ندارد.

اطلاعات در SSD روی تراشه‌های حافظه NAND ذخیره می‌شوند.

SSDهای Enterprise

SSDهای سازمانی برای استفاده در سرورها طراحی شده‌اند.

ویژگی‌های آن‌ها:

  • طول عمر بالاتر
  • تحمل نوشتن بیشتر
  • Firmware حرفه‌ای
  • قابلیت محافظت در برابر قطع برق
  • عملکرد پایدار در بار سنگین

پارامتر مهم در این SSDها:

DWPD (Drive Writes Per Day) است که این مقدار نشان می‌دهد چند بار می‌توان کل ظرفیت SSD را در هر روز بازنویسی کرد.

تفاوت HDD و SSD در سرورها

ویژگیHDDSSD
فناوریمکانیکیحافظه فلش
سرعتکمتربسیار بیشتر
تأخیربالابسیار کم
IOPS (تعداد عملیات ورودی و خروجی در هر ثانیه)پایینبسیار بالا
مصرف برقبیشترکمتر
مقاومت ضربهکمتربیشتر
قیمت هر گیگابایتکمتربیشتر
ظرفیت بالاعالیدر حال رشد
مناسب دیتابیسمتوسطعالی
مناسب آرشیوعالیمناسب

انواع درگاه اتصال هارد به سرور

Serial Advanced Technology Attachment :SATA

یک رابط ارتباطی برای اتصال تجهیزات ذخیره‌سازی است.

SATA بیشتر در:

  • کامپیوترهای شخصی
  • سرورهای اقتصادی
  • ذخیره‌سازی ظرفیت بالا

استفاده می‌شود.

نسخه‌های رایج:

  • SATA II
  • SATA III

حداکثر سرعت تئوری SATA III حدود 6Gb/s است.

Serial Attached SCSI :SAS

یک رابط حرفه‌ای برای محیط‌های سازمانی است.

تفاوت‌های SAS با SATA:

  • قابلیت اطمینان بالاتر
  • امکان اتصال تعداد بیشتری دیسک
  • عملکرد بهتر در بار کاری سنگین
  • قابلیت Dual Port در برخی مدل‌ها

SAS معمولاً در:

  • سرورهای سازمانی
  • Storage Arrayها
  • مراکز داده

استفاده می‌شود.

Non-Volatile Memory Express :NVMe

یک پروتکل ارتباطی جدید برای SSDهای پرسرعت است.

برخلاف SATA که برای هاردهای مکانیکی طراحی شده بود، NVMe از ابتدا برای حافظه‌های فلش ساخته شده است.

NVMe معمولاً از مسیر PCI Expressاستفاده می‌کند.

مزایای NVMe

  • سرعت بسیار بالا
  • تأخیر بسیار کم
  • تعداد عملیات I/O زیاد
  • مناسب هوش مصنوعی
  • مناسب دیتابیس‌های بزرگ
  • مناسب مجازی‌سازی

نسل‌های جدید NVMe در مراکز داده می‌توانند به سرعت‌های چندین گیگابایت بر ثانیه برسند.

مقایسه SATA، SAS و NVMe

ویژگیSATASASNVMe
کاربرد اصلیعمومیسازمانیEnterprise High Performance
سرعتمتوسطبالابسیار بالا
تأخیرمتوسطکمبسیار کم
هزینهکمتربیشتربیشتر
مناسب دیتابیسمتوسطخوبعالی
مناسب مجازی‌سازیمتوسطخوبعالی

انتخاب صحیح ذخیره‌سازی در سرورها

هیچ فناوری ذخیره‌سازی برای همه کاربردها بهترین نیست.

انتخاب مناسب به نوع بار کاری بستگی دارد:

فایل سرور

معمولاً:

  • HDD Enterprise
  • RAID مناسب

دیتابیس

معمولاً:

  • SSD Enterprise
  • NVMe
  • RAID 10

Backup

معمولاً:

  • HDD ظرفیت بالا

مجازی‌سازی

معمولاً:

  • SSD یا NVMe
  • IOPS بالا
  • Latency کم

RAID؛ ستون فقرات حفاظت و دسترس‌پذیری اطلاعات در سرورها

اگر از مدیران مراکز داده بپرسید مهم‌ترین فناوری برای افزایش دسترس‌پذیری اطلاعات چیست، احتمالاً یکی از اولین پاسخ‌ها RAID خواهد بود. تقریباً تمام سرورهای سازمانی، تجهیزات ذخیره‌سازی (Storage Array)، سامانه‌های NAS و SAN و حتی بسیاری از ایستگاه‌های کاری حرفه‌ای از نوعی RAID استفاده می‌کنند.

با وجود محبوبیت این فناوری، هنوز هم یکی از رایج‌ترین سوءبرداشت‌ها این است که RAID را با نسخه پشتیبان (Backup) یکسان می‌دانند. در حالی که RAID و Backup دو فناوری کاملاً متفاوت هستند که هرکدام هدف مشخصی دارند.

RAID برای افزایش قابلیت دسترس‌پذیری (Availability)، بهبود کارایی (Performance) و تحمل خرابی (Fault Tolerance) طراحی شده است؛ اما نمی‌تواند جایگزین یک راهکار پشتیبان‌گیری مناسب باشد.

در این فصل، RAID را از پایه تا سطح تخصصی بررسی خواهیم کرد.

Redundant Array of Independent Disks :RAID

که در فارسی می‌توان آن را «آرایه افزونه‌ای از دیسک‌های مستقل» ترجمه کرد.

در RAID چند دیسک فیزیکی به گونه‌ای با یکدیگر ترکیب می‌شوند که سیستم‌عامل آن‌ها را به‌عنوان یک فضای ذخیره‌سازی واحد مشاهده کند. بسته به نوع RAID، داده‌ها ممکن است بین دیسک‌ها تقسیم شوند، روی چند دیسک به‌صورت هم‌زمان کپی شوند یا همراه با اطلاعات افزونه (Parity) ذخیره گردند.

به بیان ساده، RAID مانند تیمی از چندین دیسک است که برای رسیدن به هدفی مشترک با هم همکاری می‌کنند؛ این هدف می‌تواند افزایش سرعت، افزایش امنیت داده یا ترکیبی از هر دو باشد.

چرا RAID به وجود آمد؟

در دهه‌های ابتدایی توسعه رایانه‌ها، ظرفیت و سرعت دیسک‌های سخت محدود بود و خرابی آن‌ها می‌توانست باعث از دست رفتن اطلاعات مهم شود. پژوهشگران به دنبال راهکاری بودند تا با ترکیب چند دیسک، هم ظرفیت بیشتری به دست آورند و هم در برابر خرابی یک دیسک مقاومت ایجاد کنند.

نتیجه این تلاش‌ها، فناوری RAID بود که بعدها به استانداردی در طراحی زیرساخت‌های ذخیره‌سازی تبدیل شد.

اهداف اصلی RAID

یک آرایه RAID معمولاً با یکی یا چند هدف زیر طراحی می‌شود:

  • افزایش سرعت خواندن اطلاعات
  • افزایش سرعت نوشتن اطلاعات
  • افزایش ظرفیت قابل استفاده
  • تحمل خرابی یک یا چند دیسک
  • کاهش زمان ازکارافتادگی سرویس‌ها
  • افزایش دسترس‌پذیری اطلاعات

اما همه انواع RAID تمام این اهداف را هم‌زمان برآورده نمی‌کنند؛ هر سطح RAID مزایا و محدودیت‌های خاص خود را دارد.

RAID چه کاری انجام نمی‌دهد؟

شناخت محدودیت‌های RAID به اندازه شناخت قابلیت‌های آن اهمیت دارد.

RAID نمی‌تواند از اطلاعات در برابر موارد زیر محافظت کند:

  • حذف تصادفی فایل‌ها
  • فرمت شدن پارتیشن
  • حملات باج‌افزاری
  • آلودگی به بدافزار
  • خراب شدن فایل‌سیستم
  • خطاهای نرم‌افزاری
  • خراب شدن اطلاعات در اثر اشتباه کاربران
  • آتش‌سوزی، سیل یا سرقت تجهیزات

به همین دلیل، وجود RAID هرگز جایگزین تهیه نسخه پشتیبان منظم نیست.

مفاهیم پایه RAID

برای درک نحوه عملکرد RAID لازم است با چند اصطلاح کلیدی آشنا شویم.

Disk Member

هر هارددیسک یا SSD که در آرایه حضور دارد، یک عضو (Member) محسوب می‌شود.

Array

به مجموعه دیسک‌هایی که در قالب یک RAID با هم کار می‌کنند، آرایه (Array) گفته می‌شود.

Stripe

یکی از مهم‌ترین مفاهیم RAID، Stripe است.

وقتی فایل بزرگی روی یک آرایه نوشته می‌شود، اطلاعات به بلوک‌های کوچک‌تر تقسیم شده و این بلوک‌ها بین دیسک‌ها توزیع می‌شوند. به هر نوار از این توزیع، Stripe گفته می‌شود.

اندازه Stripe (Stripe Size) بسته به نوع کنترلر و کاربرد، می‌تواند از چند کیلوبایت تا چند مگابایت متغیر باشد. انتخاب اندازه مناسب Stripe بر کارایی سیستم تأثیر مستقیم دارد؛ برای مثال، پایگاه‌های داده و فایل‌های ویدئویی ممکن است به اندازه‌های متفاوتی نیاز داشته باشند.

Chunk

هر بخش از Stripe که روی یک دیسک نوشته می‌شود، Chunk نام دارد. در واقع Stripe از چند Chunk تشکیل شده است که روی دیسک‌های مختلف قرار می‌گیرند.

Mirroring

در برخی سطوح RAID، اطلاعات به‌طور هم‌زمان روی دو یا چند دیسک نوشته می‌شوند. این فرآیند را Mirroring یا آینه‌سازی می‌نامند.

مزیت اصلی Mirroring این است که در صورت خرابی یکی از دیسک‌ها، نسخه دیگری از اطلاعات بدون وقفه در دسترس خواهد بود.

Parity

Parity مهم‌ترین مفهوم در RAIDهای مبتنی بر تحمل خرابی مانند RAID 5 و RAID 6 است.

برخلاف تصور بسیاری از کاربران، Parity نسخه کپی اطلاعات نیست؛ بلکه داده‌ای است که از طریق عملیات ریاضی روی بلوک‌های اطلاعاتی تولید می‌شود. در صورت از دست رفتن یکی از دیسک‌ها، کنترلر RAID با استفاده از این داده و بلوک‌های باقی‌مانده می‌تواند اطلاعات دیسک خراب را بازسازی کند.

به زبان ساده، Parity مانند مجموعه‌ای از سرنخ‌های ریاضی است که امکان بازسازی اطلاعات گمشده را فراهم می‌کند.

Hot Spare

در برخی آرایه‌ها، یک یا چند دیسک به‌عنوان Hot Spare تعریف می‌شوند. این دیسک‌ها در شرایط عادی اطلاعاتی ذخیره نمی‌کنند، اما اگر یکی از دیسک‌های اصلی خراب شود، کنترلر RAID به‌طور خودکار از Hot Spare استفاده کرده و فرآیند بازسازی (Rebuild) را آغاز می‌کند.

این قابلیت زمان بازگشت آرایه به وضعیت ایمن را کاهش می‌دهد و نیاز به دخالت فوری مدیر سیستم را کمتر می‌کند.

Global Spare و Dedicated Spare

  • Dedicated Spare: فقط برای یک آرایه خاص رزرو شده است.
  • Global Spare: می‌تواند در صورت خرابی، جایگزین هر آرایه سازگار در همان کنترلر شود.

در مراکز داده بزرگ، استفاده از Global Spare انعطاف‌پذیری بیشتری ایجاد می‌کند.

کنترلر RAID چگونه کار می‌کند؟

کنترلر RAID مغز متفکر آرایه است. تمام درخواست‌های خواندن و نوشتن ابتدا به این کنترلر ارسال می‌شوند و سپس کنترلر بر اساس نوع RAID تصمیم می‌گیرد که داده‌ها چگونه روی دیسک‌ها توزیع شوند.

وظایف اصلی کنترلر عبارت‌اند از:

  • تقسیم داده‌ها به Stripe و Chunk
  • محاسبه و ذخیره Parity
  • مدیریت Cache
  • پایش سلامت دیسک‌ها
  • تشخیص خرابی دیسک
  • آغاز فرآیند Rebuild
  • ثبت و نگهداری اطلاعات پیکربندی آرایه (Metadata)

به همین دلیل، خرابی کنترلر RAID می‌تواند دسترسی به اطلاعات را مختل کند، حتی اگر همه دیسک‌ها سالم باشند.

انواع کنترلر RAID

۱. RAID سخت‌افزاری (Hardware RAID)

در این روش، کنترلر اختصاصی با پردازنده و حافظه Cache عملیات RAID را انجام می‌دهد.

مزایا:

  • کارایی بالا
  • کاهش بار پردازنده اصلی
  • امکانات مدیریتی گسترده
  • مناسب برای محیط‌های سازمانی

معایب:

  • هزینه بیشتر
  • وابستگی به مدل و Firmware کنترلر

۲. RAID نرم‌افزاری (Software RAID)

در این روش، سیستم‌عامل وظیفه مدیریت آرایه را بر عهده دارد.

نمونه‌های شناخته‌شده:

  • Linux mdadm
  • Windows Storage Spaces
  • Apple RAID
  • ZFS RAID-Z
  • Btrfs RAID

مزایا:

  • هزینه کمتر
  • انعطاف‌پذیری بیشتر
  • وابستگی کمتر به سخت‌افزار

معایب:

  • مصرف بخشی از منابع CPU
  • کارایی پایین‌تر در برخی سناریوها

Cache در کنترلر RAID

برای افزایش سرعت، بسیاری از کنترلرهای حرفه‌ای دارای حافظه Cache هستند.

دو سیاست رایج برای مدیریت نوشتن داده‌ها عبارت‌اند از:

Write Through

در این روش، داده ابتدا روی دیسک نوشته می‌شود و سپس پاسخ موفقیت به سیستم‌عامل ارسال می‌گردد.

مزایا:

  • امنیت بیشتر
  • ریسک کمتر در زمان قطع برق

معایب:

  • سرعت نوشتن کمتر

Write Back

در این حالت، داده ابتدا در حافظه Cache ذخیره می‌شود و سپس در فرصت مناسب روی دیسک نوشته می‌شود.

مزایا:

  • سرعت بسیار بالاتر
  • کارایی بهتر در بارهای کاری سنگین

معایب:

  • در صورت قطع برق و نبود باتری یا حافظه Flash محافظ، ممکن است داده‌های موجود در Cache از بین بروند.

به همین دلیل، کنترلرهای حرفه‌ای معمولاً به Battery Backup Unit (BBU) یا Flash Backed Write Cache (FBWC) مجهز هستند.

وضعیت‌های مختلف آرایه RAID

یک آرایه RAID ممکن است در طول عمر خود در وضعیت‌های مختلفی قرار گیرد:

  • Optimal: همه دیسک‌ها سالم هستند و آرایه به‌طور کامل عملیاتی است.
  • Degraded: یک یا چند دیسک از دست رفته‌اند، اما اطلاعات هنوز قابل دسترسی است.
  • Rebuilding: کنترلر در حال بازسازی داده‌ها روی دیسک جدید یا Hot Spare است.
  • Failed: تعداد خرابی‌ها از توان تحمل آرایه بیشتر شده و دسترسی به اطلاعات مختل شده است.
  • Offline: آرایه به‌طور موقت از دسترس خارج شده است.
  • شناخت این وضعیت‌ها برای مدیران سیستم اهمیت زیادی دارد، زیرا تصمیم‌گیری درست در هر مرحله می‌تواند از بروز خسارت‌های بزرگ‌تر جلوگیری کنند.

بررسی جامع سطوح مختلف RAID؛ از RAID 0 تا RAID 60

اکنون که با مفهوم RAID، اجزای تشکیل‌دهنده آن و نحوه عملکرد کنترلرهای RAID آشنا شدیم، زمان آن رسیده است که انواع مختلف RAID را بررسی کنیم. هر سطح RAID برای هدف خاصی طراحی شده است و انتخاب نادرست آن می‌تواند منجر به کاهش کارایی، افزایش هزینه یا حتی از دست رفتن اطلاعات شود.

یکی از اشتباهات رایج این است که تصور شود «RAID بالاتر، بهتر است». در واقع، انتخاب RAID باید بر اساس نیازهای واقعی سازمان، نوع بار کاری (Workload)، بودجه، میزان اهمیت اطلاعات و سطح تحمل خرابی مورد انتظار انجام شود.

در این فصل، علاوه بر معرفی هر سطح RAID، مزایا، معایب، کاربردهای متداول و ملاحظات طراحی آن نیز بررسی می‌شود.

RAID 0؛ بیشترین سرعت، بدون هیچ افزایشی

RAID 0 ساده‌ترین سطح RAID است. در این ساختار، اطلاعات به بلوک‌های کوچک تقسیم شده و به‌صورت متوالی بین تمام دیسک‌ها توزیع می‌شوند. این فرآیند Striping نام دارد.

به‌عنوان مثال، اگر دو هارد در اختیار داشته باشیم، بلوک اول روی هارد اول، بلوک دوم روی هارد دوم، بلوک سوم دوباره روی هارد اول و به همین ترتیب ذخیره می‌شود.

در نتیجه، هنگام خواندن یا نوشتن اطلاعات، هر دو هارد به‌ صورت هم‌زمان فعالیت می‌کنند و سرعت افزایش می‌یابد.

حداقل تعداد هارد مورد استفاده۲ عدد هارد است و ظرفیت قابل استفاده برابر با مجموع ظرفیت تمام هاردها است.

مزایا

  • بیشترین سرعت خواندن و نوشتن
  • استفاده کامل از ظرفیت هاردها
  • پیاده‌سازی ساده
  • مناسب برای پردازش فایل‌های حجیم

معایب

RAID 0 هیچگونه تحمل خرابی ندارد.

اگر تنها یکی ازهاردها خراب شود، کل آرایه از دسترس خارج می‌شود و بخش‌هایی از داده که روی سایرهاردها نیز قرار دارند، بدون بازسازی تخصصی قابل استفاده نخواهند بود.

به همین دلیل، RAID 0 برای اطلاعات حیاتی توصیه نمی‌شود.

کاربردهای متداول

  • پردازش ویدئو
  • رندر سه‌بعدی
  • فایل‌های موقت
  • فضای Scratch در نرم‌افزارهای گرافیکی
  • داده‌هایی که نسخه پشتیبان مستقل دارند

RAID 1؛ آینه‌سازی اطلاعات

در RAID 1 هر اطلاعاتی که روی یک هارد نوشته می‌شود، به‌صورت هم‌زمان روی هارد دیگر نیز ذخیره می‌شود.

در نتیجه، هر دو هارد نسخه‌ای کاملاً مشابه از اطلاعات را نگهداری می‌کنند.

به این روش Mirroring گفته می‌شود.

حداقل ۲ هارد مورد استفاده قرار میگیرد و تنها نیمی از مجموع ظرفیت هاردها قابل استفاده است.

مزایا

  • بازسازی نسبتاً سریع
  • عملکرد مناسب در خواندن اطلاعات
  • پیاده‌سازی ساده
  • امنیت بالا

معایب

  • هزینه بیشتر
  • استفاده از تنها ۵۰ درصد ظرفیت
  • افزایش ظرفیت نیازمند افزودن هاردهای جفتی

کاربردهای متداول

  • سیستم‌عامل سرورها
  • سرورهای Domain Controller
  • سرورهای مالی
  • اطلاعات حساس
  • پایگاه‌های داده کوچک

RAID 5؛ تعادل میان ظرفیت و امنیت

RAID 5 یکی از محبوب‌ترین و پراستفاده‌ترین سطوح RAID در سرورهای سازمانی است.

در این روش، علاوه بر توزیع داده‌ها، اطلاعات Parity نیز میان تمام هاردها توزیع می‌شود.

برخلاف تصور رایج، هارد مخصوص Parity وجود ندارد؛ بلکه محل ذخیره Parity در هر Stripe تغییر می‌کند تا بار کاری بین هاردها متعادل شود.

حداقل ۳ هارد مورد استفاده قرار میگیرد و ظرفیت یک هارد صرف Parity می‌شود بنابراین حداکثر تحمل خرابی، خرابی یک هارد است

(تعدادهاردها – ۱) × ظرفیت کوچک‌ترین هارد

مزایا

  • استفاده مناسب از ظرفیت
  • سرعت خوب در خواندن
  • امنیت مناسب
  • هزینه کمتر نسبت به RAID 10

معایب

  • نوشتن کندتر نسبت به RAID 10
  • بازسازی زمان‌بر
  • فشار زیاد روی هاردهای سالم هنگام Rebuild
  • احتمال افزایش ریسک در آرایه‌های بسیار بزرگ

کاربردها

  • File Server
  • NAS
  • آرشیو اطلاعات
  • Storageهای سازمانی

فرآیند Rebuild در RAID 5

هنگامی که یکی از هارددیسک‌ها خراب می‌شود، کنترلر RAID با استفاده از داده‌های موجود و Parity، اطلاعات هارددیسک از دست‌رفته را محاسبه کرده و روی هارددیسک جایگزین بازسازی می‌کند.

در این مدت:

  • عملکرد سیستم کاهش می‌یابد.
  • فشار کاری روی دیسک‌های باقی‌مانده افزایش پیدا می‌کند.
  • در صورت خرابی دیسک دوم، کل آرایه ممکن است از دسترس خارج شود.

RAID 6؛ تحمل خرابی بیشتر

RAID 6 نسخه توسعه‌یافته RAID 5 است.

تفاوت اصلی این دو در استفاده از دو بلوک Parity مستقل است.

به همین دلیل، RAID 6 می‌تواند هم‌زمان خرابی دو هارد را تحمل کند.

حداقل تعداد دیسک۴ هارد استفاده میشود وظرفیت دو هارد صرف اطلاعات Parity می‌شود.

(تعداد هاردها – ۲) × ظرفیت کوچک‌ترین هارد

مزایا

  • تحمل خرابی دو هارد
  • مناسب برای آرایه‌های بزرگ
  • امنیت بیشتر نسبت به RAID 5

معایب

  • سرعت نوشتن کمتر
  • محاسبات Parity پیچیده‌تر
  • زمان Rebuild طولانی‌تر

کاربردها

  • Storageهای Enterprise
  • مراکز داده
  • سامانه‌های آرشیوی
  • ذخیره‌سازی اطلاعات حیاتی

RAID 10؛ ترکیب بهترین ویژگی‌های RAID 1 و RAID 0

RAID 10 که گاهی با نام RAID 1+0 نیز شناخته می‌شود، یکی از محبوب‌ترین گزینه‌ها برای سرورهای حساس است.

در این ساختار، ابتدا دیسک‌ها به‌صورت جفت‌های آینه (RAID 1) سازمان‌دهی می‌شوند و سپس این جفت‌ها به‌صورت Striping (RAID 0) با یکدیگر ترکیب می‌شوند.

حداقل تعداد دیسک مورد نیاز 4 هارد می باشد و ظرفیت مورد استفاده۵۰ درصد ظرفیت کل است

مزایا

  • سرعت بسیار بالا
  • تحمل خرابی مناسب
  • بازسازی سریع‌تر نسبت به RAID 5 و RAID 6
  • عملکرد عالی در بارهای تصادفی (Random I/O)

معایب

  • هزینه بیشتر
  • استفاده از تنها نیمی از ظرفیت

کاربردها

  • پایگاه‌های داده
  • Oracle
  • Microsoft SQL Server
  • VMware
  • Hyper-V
  • سیستم‌های مالی
  • سامانه‌های بانکی

RAID 50

RAID 50 ترکیبی از چند آرایه RAID 5 است که روی آن‌ها RAID 0 پیاده‌سازی شده است.

به بیان ساده:

چند گروه RAID 5 ایجاد می‌شوند و سپس این گروه‌ها به‌صورت Striping با یکدیگر ترکیب می‌شوند.

مزایا

  • سرعت بیشتر نسبت به RAID 5
  • ظرفیت مناسب
  • تحمل خرابی بهتر

کاربردها

  • Storageهای بزرگ
  • File Serverهای سازمانی
  • مراکز داده متوسط

RAID 60

RAID 60 مشابه RAID 50 است، با این تفاوت که هر گروه داخلی از نوع RAID 6 است.

در نتیجه، هر گروه می‌تواند خرابی دو دیسک را تحمل کند.

مزایا

  • امنیت بسیار بالا
  • مناسب آرایه‌های بسیار بزرگ
  • کاهش ریسک خرابی

معایب

  • هزینه بیشتر
  • ظرفیت قابل استفاده کمتر
  • پیچیدگی بالاتر

کاربردها

  • مراکز داده بزرگ
  • سامانه‌های بانکی
  • ذخیره‌سازی پزشکی
  • مراکز تحقیقاتی
  • آرشیوهای چندصد ترابایتی

مقایسه RAIDها

RAIDحداقل دیسکتحمل خرابیظرفیت قابل استفادهکارایی خواندنکارایی نوشتنکاربرد اصلی
RAID 02ندارد100٪بسیار بالابسیار بالاپردازش موقت
RAID 121هارد50٪بالامتوسطسیستم‌عامل، داده حساس
RAID 531هارد(N−1)بالامتوسطفایل سرور، NAS
RAID 642 هارد(N−2)بالامتوسطآرشیو و سازمانی
RAID 104بسته به جفت‌ها50٪بسیار بالابسیار بالادیتابیس، مجازی‌سازی
RAID 506وابسته به هر گروهبالابالابالاStorage سازمانی
RAID 608دو هارد در هرگروهمتوسطبالامتوسطمراکز داده بزرگ

انتخاب RAID

انتخاب RAID نباید صرفاً بر اساس سرعت یا ظرفیت انجام شود. مدیران زیرساخت معمولاً عوامل زیر را بررسی می‌کنند:

  • نوع بار کاری: آیا حجم عملیات خواندن بیشتر است یا نوشتن؟
  • اندازه فایل‌ها: فایل‌های کوچک، پایگاه داده یا فایل‌های حجیم ویدئویی؟
  • اهمیت اطلاعات: آیا از دست رفتن حتی چند دقیقه سرویس قابل قبول است؟
  • بودجه: هزینه دیسک‌ها، کنترلر و فضای رک.
  • زمان بازسازی (Rebuild): هرچه دیسک‌ها بزرگ‌تر باشند، بازسازی طولانی‌تر خواهد بود.
  • برنامه پشتیبان‌گیری: RAID بدون Backup کافی نیست.

به‌عنوان نمونه:

  • پایگاه‌های داده و مجازی‌سازی: معمولاً RAID 10 بهترین تعادل میان کارایی و پایداری را ارائه می‌دهد.
  • فایل‌سرورها و آرشیو: RAID 6 یا RAID 60 به دلیل تحمل خرابی بیشتر، گزینه‌های مناسب‌تری هستند.
  • فضای موقت پردازش: RAID 0 تنها زمانی توصیه می‌شود که از داده‌ها نسخه پشتیبان وجود داشته باشد و از دست رفتن آن‌ها مشکل‌ساز نباشد.

باورهای نادرست درباره RAID

پیش از پایان این فصل، لازم است به چند تصور اشتباه رایج اشاره کنیم:

  • «RAID یعنی Backup» → نادرست. RAID از حذف فایل یا باج‌افزار محافظت نمی‌کند.
  • «هرچه تعداد دیسک بیشتر باشد، امنیت بیشتر است» → لزوماً خیر؛ طراحی آرایه اهمیت بیشتری دارد.
  • «RAID 5 همیشه بهترین انتخاب است» → با افزایش ظرفیت دیسک‌ها، در بسیاری از کاربردهای جدید RAID 6 یا RAID 10 انتخاب مناسب‌تری هستند.
  • «خرابی یک دیسک یعنی اطلاعات از بین رفته‌اند» → در بسیاری از سطوح RAID، تا زمانی که تعداد خرابی‌ها از حد تحمل آرایه بیشتر نشود، اطلاعات قابل دسترسی باقی می‌مانند.

و در پایان

به طور خلاصه، سرور بدون RAID در برابر خطاهای سخت‌افزاری کاملاً آسیب‌پذیر است و RAID بدون سرور کارایی معنایی ندارد؛ ترکیب این دو، پایداری دیجیتال را رقم می‌زند، ترکیب یک معماری سرور منسجم با سطح مناسبی از RAID، تعادل بهینه‌ای میان سرعت (Performance)، پایداری (Reliability) و تداوم کسب‌وکار (Business Continuity) ایجاد می‌سازد.

به بررسی معماری‌های ذخیره‌سازی DAS، NAS و SAN خواهیم پرداخت؛ سه رویکرد اصلی که امروزه در سازمان‌ها، مراکز داده و زیرساخت‌های ابری برای مدیریت و اشتراک‌گذاری اطلاعات مورد استفاده قرار می‌گیرند. علاوه بر معرفی هر معماری، تفاوت‌ها، مزایا، محدودیت‌ها و کاربردهای عملی آن‌ها نیز بررسی خواهد شد.

بدون دیدگاه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *