خبر و ترفند روز

خبر و ترفند های روز را اینجا بخوانید!

هارددیسک من سالم به نظر می‌رسید، اما این داشبورد نشانه‌های هشدار را آشکار کرد

هارددیسک من سالم اعلام شده بود، اما پیشخوان Scrutiny نشانه‌های هشداردهنده را آشکار کرد
این هارددیسک مکانیکی از همهٔ آزمون‌ها سربلند بیرون آمد، اما پیش از آنکه فایل‌های چندرسانه‌ای‌ام را به دستش بسپارم، دلایل کافی برای تعویضش داشتم

مدتی پیش، یک مینی‌پی‌سی قدیمی Intel NUC به من هدیه دادند. نمی‌دانستم پیش از رسیدن به دست من چه کاربردی داشته، اما سرانجام آن را به رایانهٔ پخش چندرسانه‌ای برای تلویزیون هوشمند سالخورده‌ام تبدیل کردم. هارددیسک مکانیکی 1TB آن برای نگهداری یک کتابخانهٔ چندرسانه‌ای محلی فضای فراوانی داشت و مرا از وابستگی به حافظه‌های بیرونی بی‌نیاز می‌کرد.

مشکل اینجا بود که هارددیسک ۱۳ سال عمر داشت و گاه‌وبیگاه صداهای نگران‌کننده‌ای از خود درمی‌آورد که باعث می‌شد چشم از تلویزیون بردارم و نگاهی به آن بیندازم. بااین‌حال، بررسی سریعی با ابزارهای پایه همچنان نتیجهٔ PASSED را نشان می‌داد و ابزار بررسی دیسک لینوکس نیز همین نظر را داشت.

به‌جای آنکه تنها به یک آزمایش اطمینان‌بخش اعتماد کنم، برنامهٔ رایگان و متن‌باز Scrutiny را نصب کردم تا ببینم دیسک واقعاً سالم است یا آرام‌آرام به مرز خرابی نزدیک می‌شود.

نخستین بررسی‌ها، هارددیسک را کاملاً سالم نشان دادند

حکم سبز و اطمینان‌بخش، گذشته‌ای طولانی را پنهان کرده بود

کار را با سریع‌ترین بررسی‌ای که به ذهنم می‌رسید آغاز کردم:

sudo smartctl -H /dev/sda

نتیجه هم خیال‌جمع‌کن بود و هم کمی شک‌برانگیز:

SMART overall-health self-assessment test result: PASSED

ابزار Disks در Linux Mint نیز همین نتیجه را تأیید کرد. از نظر هر دو ابزار، هارددیسک HGST (Hitachi) هیچ مشکل فاجعه‌باری نداشت. بررسی دقیق ویژگی‌های جداگانهٔ S.M.A.R.T (فناوری خودنظارتی، تحلیل و گزارش‌دهی) نیز در نگاه نخست نشانی از فاجعه‌ای آشکار نکرد. وضعیت اولیهٔ من چنین بود:

ویژگی SMART مقدار
بخش‌های بازتخصیص‌یافته
بخش‌های در انتظار کنونی
بخش‌های اصلاح‌ناپذیر در حالت آفلاین
خطاهای CRC
ساعت‌های روشن‌بودن ۱۱٬۱۳۶ ساعت
چرخه‌های بارگذاری و تخلیه ۴۰۳٬۷۱۵
تعداد جمع‌شدن هد هنگام قطع برق ۶۶
بیشترین دمای ثبت‌شده ۵۳°C
خودآزمایی‌های پیشین SMART هیچ موردی ثبت نشده است

از میان انبوه همیشگی خروجی SMART، تنها ویژگی‌های سودمندتر را جدا کردم:

sudo smartctl -A /dev/sda |
grep -E 'Reallocated_Sector|Power_On_Hours|Load_Cycle|Current_Pending|Offline_Uncorrectable'

Scrutiny این تفاوت را بسیار روشن‌تر نشان داد. جدول عادی آن برای «تعداد چرخه‌های بارگذاری» فقط مقدار 60 را نمایش می‌داد، اما این صرفاً مقدار نرمال‌شدهٔ SMART بود. با بازکردن جزئیات این ویژگی، شمار خام 403,715 در زیر آن نمایان شد.

این عدد ترسناک به نظر می‌رسید، اما لزوماً به معنای خراب‌شدن دیسک نبود. HGST برای این نوع دیسک دست‌کم ۶۰۰٬۰۰۰ چرخهٔ عادی بارگذاری و تخلیه را تضمین می‌کند. بااین‌همه، این عدد نشان می‌داد که دیسک من پیش‌تر نزدیک به دوسوم این میزان را پشت سر گذاشته است.

مطلب مرتبط:   این یک سنسور را تمیز کنید تا یک تقویت MPG فوری دریافت کنید

برای مقایسه، من معمولاً موارد زیر را نشانهٔ هشدار می‌دانم:

مورد SMART نتیجهٔ من آنچه مرا نگران می‌کند
بخش‌های بازتخصیص‌یافته هرگونه بازتخصیص تازه
بخش‌های در انتظار هر مقدار غیرصفر
بخش‌های اصلاح‌ناپذیر در حالت آفلاین هر مقدار غیرصفر
خطاهای UDMA CRC افزایش شمار خطاها که می‌تواند نشانهٔ مشکل کابل SATA باشد
ساعت‌های روشن‌بودن ۱۱٬۱۳۶ هر عددی بالاتر از آستانه تعیین‌شدهٔ سازنده
چرخه‌های بارگذاری و تخلیه هد ۴۰۳٬۷۱۵ هر عددی بالاتر از آستانهٔ تعیین‌شدهٔ سازنده برای چرخه‌های عادی مفروض
عقب‌کشیدن هد هنگام قطع برق ۶۶ بیش از ۲۰٬۰۰۰ بار تخلیهٔ اضطراری هد
دما حداکثر ۵۳ درجه سانتی‌گراد (۱۲۷٫۴ درجه فارنهایت) هر عددی فراتر از محدودهٔ دمایی ایمن دیسک

در مستندات خود HGST، عمر کاری این درایو با فرض بارهای کاری معمول، حدود پنج سال یا ۲۰٬۰۰۰ ساعت روشن‌بودن اعلام شده است. محدودهٔ دمای کارکرد آن نیز ۰ تا ۶۰ درجه سانتی‌گراد (۳۲ تا ۱۴۰ درجه فارنهایت) ذکر شده است. البته این اعداد بر فرض‌های بسیاری استوارند و نباید آن‌ها را زمان‌شمار پایان عمر درایو دانست. رسیدن کارکرد درایو به ۲۰٬۰۰۰ ساعت به این معنا نیست که در ساعت ۲۰٬۰۰۱ از پا درمی‌آید.

اسکروتینی تفاوت سلامت و فرسودگی را برایم روشن کرد

داشبورد، اعداد را به‌جای دفن‌کردن در خروجی SMART، فهمیدنی کرد

نتایج خام و گسترش‌یافتهٔ ویژگی ساعات روشن‌بودن در Scrutiny

smartctl پیش‌تر داده‌های خام فراوانی در اختیارم گذاشته بود؛ اما راستش را بخواهید، نتایج بیشتر به کار مهندسان هارددیسک می‌آمد تا من. با نصب اسکروتینی، تفسیر همان اطلاعات بسیار آسان‌تر شد. بنابراین نسخهٔ ۰٫۹٫۳ آن را با داکر کامپوز روی NUC نصب کردم و دسترسی به درایو فیزیکی را در اختیارش گذاشتم:

services:
  scrutiny:
    image: ghcr.io/analogj/scrutiny:v0.9.3-omnibus
    cap_add:
      - SYS_RAWIO
    devices:
      - /dev/sda:/dev/sda
    volumes:
      - /run/udev:/run/udev:ro

سپس آن را با این دستور اجرا کردم:

docker compose up -d

اسکروتینی قابلیتی برای ثبت تاریخچه داشت که SMART از آن بی‌بهره بود. این برنامه به‌جای آنکه فقط یک‌بار درایو را بررسی کند و نتیجه به فراموشی سپرده شود، داده‌های هر نوبت گردآوری را نگه می‌داشت و تغییرات درایو را در گذر زمان به‌صورت نمودار نشان می‌داد. به‌این‌ترتیب، پاسخ‌دادن به پرسش‌هایی که بیش از همه برایم اهمیت داشتند بسیار آسان‌تر شد:

  • آیا دما هنگام کار پیوسته بالا می‌رفت؟ بله
  • آیا شمار چرخه‌های بارگذاری با شتاب زیادی افزایش می‌یافت؟ خیر
  • آیا سکتور معلق یا بازتخصیص‌یافته‌ای وجود داشت؟ خیر
  • آیا هیچ‌یک از ویژگی‌ها در فاصلهٔ میان بررسی‌ها بدتر شده بود؟ خیر
مطلب مرتبط:   نحوه تشخیص نوع پورت USB
نمودار دمای Scrutiny با جهش دما در آزمون کوتاه و تغییرات دما در گذر زمان طی آزمون طولانی

این برنامه همچنین چند نتیجهٔ SMART را که در آغاز نامفهوم به نظر می‌رسیدند، روشن کرد. اسکروتینی مقدار ساعت‌های روشن‌بودن را ۷۵ نشان می‌داد؛ اما با بازکردن آن ردیف مشخص شد که عدد واقعی بیش از ۱۱٬۱۳۶ ساعت است. دربارهٔ شمار چرخه‌های بارگذاری نیز همین اتفاق افتاد: مقدار نرمال‌شدهٔ ۶۰، شمار خام واقعیِ بیش از ۴۰۳٬۰۰۰ چرخه را پنهان کرده بود.

باز هم باید گفت که این اعداد فقط زمینه‌ای برای ارزیابی‌اند، نه زمان‌شمار پایان عمر. Scrutiny پیش‌بینی نمی‌کرد که هارددیسک من با احتمال x% خراب خواهد شد. دیدن همین زمینه دقیقاً همان چیزی بود که نیاز داشتم، زیرا نشان می‌داد هارددیسک پیش‌تر چه میزان کار و فشار را پشت سر گذاشته است.

پیش از آزمایش پرفشار یک درایو قدیمی، یک نمای پایه از داده‌های SMART ثبت کنید. اگر نتایج نشان‌دهندهٔ سکتورهای معلق، بازتخصیص‌یافته یا اصلاح‌ناپذیر بود، دیسک را در آستانهٔ خرابی در نظر بگیرید. آزمایش دیگری انجام ندهید و بی‌درنگ پشتیبان‌گیری و خارج‌کردن داده‌هایتان را آغاز کنید.

درایو قدیمی را واداشتم توانایی‌اش را در عمل ثابت کند

همهٔ خودآزمایی‌ها را پشت سر گذاشت، اما هنگام نوشتن پیوسته چندان مطمئن به گوش نمی‌رسید

نتایج آزمون کوتاه SMART برای هارددیسک

اسکروتینی نشان داده بود این دیسک چه عمر پرفشاری را پشت سر گذاشته است؛ اما دیگر به نتیجهٔ آسان‌گیرانهٔ «موفق» اعتماد نکردم و وادارش کردم کاری جدی انجام دهد. کار را با خودآزمایی‌های داخلی SMART آغاز کردم:

sudo smartctl -t short /dev/sda
sudo smartctl -l selftest /dev/sda

آزمایش کوتاه در کارکرد ۱۱٬۱۳۹ ساعت، ظرف دو دقیقه و بدون خطا به پایان رسید. این نتیجه برای یک آزمایش کوتاه رضایت‌بخش بود، اما بررسی کامل‌تری می‌خواستم:

sudo smartctl -t long /dev/sda
sudo smartctl -l selftest /dev/sda

این آزمایش حدود سه ساعت طول کشید و هارددیسک در تمام این مدت صداهای نگران‌کنندهٔ زیادی تولید می‌کرد. آزمایش گسترده در کارکرد ۱۱٬۱۴۳ ساعت، بدون هیچ خطایی به پایان رسید. این نتیجه اهمیت بیشتری داشت، زیرا درایو واقعاً سطح ذخیره‌سازی خود را پویش کرده بود و تنها گزارش نمی‌داد که هیچ‌یک از آستانه‌های خرابی رد نشده‌اند.

نتایج آزمون طولانی SMART برای هارددیسک همراه با ویژگی‌های گسترش‌یافته

پس از هر دو آزمایش، شاخص‌های مهم همچنان کاملاً پاک بودند. شمار سکتورهای بازتخصیص‌یافته و معلق هنوز صفر بود. شمار سکتورهای اصلاح‌ناپذیر در حالت برون‌خط نیز صفر باقی ماند، چرخه‌های بارگذاری همچنان ۴۰۳٬۷۱۵ بود و دمای درایو دوباره به محدودهٔ عادی کارکرد خود، یعنی ۳۹ تا ۴۰ درجه سانتی‌گراد (۱۰۲٫۲ تا ۱۰۴ درجه فارنهایت)، بازگشته بود.

مطلب مرتبط:   تجارت کریپتو: قیمت پیشنهادی، قیمت درخواستی و توزیع توضیح داده شده است

بعد، همان کاری را شبیه‌سازی کردم که در اصل از این درایو انتظار داشتم. یک نوشتن ترتیبی و حجیم را آغاز کردم تا پر شدن تدریجی آن با فایل‌های چندرسانه‌ای را بازسازی کنم:

dd if=/dev/zero of=~/hdd-media-test/media-test.bin bs=64M count=800 oflag=direct status=progress

Scrutiny نشان می‌داد دما تا ۴۶°C (۱۱۴٫۸°F) بالا رفته است، اما شاخص‌های SMART همچنان همه‌چیز را سالم گزارش می‌کردند. مشکل اینجا بود که خود درایو صداهای مکانیکی هولناکی به راه انداخته بود؛ آن‌قدر بد که ناچار شدم آزمون نوشتن را متوقف کنم.

نتایج ترکیبی آزمون‌های کوتاه و طولانی SMART روی هارددیسک

چیزی که کلافه‌ام می‌کرد این بود که از صدای دیسک می‌فهمیدم حالش خوب نیست، اما بررسی‌های عمیق‌تر همچنان هیچ مشکلی نشان نمی‌دادند. گزارش‌های خطای SMART هنوز می‌گفتند «هیچ خطایی ثبت نشده است» و هستهٔ سیستم‌عامل نیز هیچ خطای ورودی‌ـ‌خروجی یا بازنشانی SATA را نشان نمی‌داد. از قضا، نگران‌کننده‌ترین نتیجهٔ کل این آزمایش‌ها همان چیزی بود که هیچ ابزار عیب‌یابی‌ای نمی‌توانست نشانم دهد.

درایو از همهٔ آزمون‌ها سربلند بیرون آمد، اما باز هم عوضش می‌کنم

سلامت کافی برای راه‌اندازی تی‌وی‌باکس، به معنای آمادگی برای ذخیره‌سازی تازه نیست

نمودار Scrutiny از جهش‌های دمای هارددیسک هنگام آزمون نوشتن

برای نگه‌داشتن این هارددیسک قدیمی دلایل کاملاً موجهی وجود دارد. هیچ سکتور بازتخصیص‌یافته، در انتظار یا اصلاح‌ناپذیری ندارد؛ خطایی در رابط دیده نمی‌شود و SMART نیز هیچ‌گونه خطایی ثبت نکرده است. هر دو آزمون کوتاه و گسترده بی‌دردسر به پایان رسیدند و حتی دمای درایو نیز در محدودهٔ عادی باقی ماند.

دیدن چنین نتایجی، در حالی که صدای درایو آشکارا از وجود مشکلی خبر می‌دهد، دست‌کم بگویم بسیار کلافه‌کننده است.

اگر تنها وظیفه‌اش راه‌اندازی لینوکس و اجرای رابط تلویزیون بود، احتمالاً فقط به‌دلیل بیش از 10K ساعت روشن‌بودن عوضش نمی‌کردم. مشکل این بود که می‌خواستم مسئولیتی بسیار سنگین‌تر به آن بسپارم.

ساختن یک آرشیو چندرسانه‌ای یعنی صدها گیگابایت داده را روی این درایو کپی کنم و سپس هر روز برای حفظ ایمن آن‌ها به درایو اعتماد داشته باشم. در چنین شرایطی، بیش از ۴۰۰,۰۰۰ چرخهٔ بارگذاری و تخلیه، عمر بالای درایو و صداهای وحشتناکی که هنگام نوشتن پیوسته تولید می‌کرد، بسیار گویاتر از نشان سبزرنگ سلامت هستند. SMART می‌تواند بیشتر نشانه‌های رایج خرابی را شناسایی کند، اما از پیش‌بینی خرابی مکانیکی، الکترونیکی یا ناگهانی ناتوان است.

راستش را بخواهید، دلم نمی‌خواهد هنگام تماشای مجموعه‌های علمی‌تخیلی محبوبم در Netflix، صدای تقلا کردن هارددیسک را هم در پس‌زمینه بشنوم.

فعلاً Scrutiny را نصب نگه می‌دارم و اجازه می‌دهم درایو همچنان از پس وظایف سبک تی‌وی‌باکس برآید؛ بااین‌حال، با سرور FOG از آن تصویر کامل تهیه می‌کنم و به‌دنبال یک درایو SSD تازه می‌گردم. از دست رفتن فیلم‌هایی که به‌سادگی جایگزین می‌شوند آخر دنیا نیست، اما ساختن دوبارهٔ آن آرشیو همچنان دردسری عظیم خواهد بود.

در نهایت، درایو از تمام آزمون‌هایی که برایش ترتیب دادم سربلند بیرون آمد. Scrutiny حدسم دربارهٔ خرابی قریب‌الوقوع آن را اثبات نکرد، اما اطلاعات کافی در اختیارم گذاشت تا بفهمم «هنوز خراب نشده» معیار مناسبی برای ادامهٔ استفاده از یک هارددیسک نیست.

منبع: این مطلب ترجمه و بومی‌سازی مقاله‌ای از MakeUseOf به قلم Gregory Gibson است. مشاهده مقاله اصلی