پردازندهها هم مانند هر قطعه الکترونیکی دیگری با گذشت زمان و کارکرد طولانی دچار فرسودگی میشوند. در سرورها که CPUها ممکن است ماهها و سالها بدون وقفه زیر بار کار کنند، این مسئله اهمیت بیشتری دارد. حالا اینتل برای پردازندههای سروری آینده خود راهکاری نرمافزاری به نام BFF آماده کرده که برای مدیریت یکی از پیامدهای این فرسودگی طراحی شده است.
ماجرا از جایی جالب میشود که مشکل الزاماً خرابی کامل پردازنده نیست. با افزایش عمر سیلیکون، ممکن است برخی بیتها در شرایط خاص در یک وضعیت ثابت گیر کنند و خطاهای تصحیحشده تکراری ایجاد شود. اینتل حالا میخواهد سیستمعامل را در مدیریت چنین وضعیتی وارد کند تا این خطاهای تکراری باعث پنهان ماندن خطاهای جدیتر نشوند.
وقتی تراشه CPU پیر میشود چه اتفاقی میافتد؟
یکی از مشکلاتی که ممکن است در اثر فرسودگی تراشه رخ دهد، Stuck Bit یا گیرکردن یک بیت در وضعیت مشخص است. سختافزارهای سروری برای مقابله با چنین خطاهایی سازوکارهای تشخیص و تصحیح دارند، اما اگر یک خطای مشابه بارها تکرار شود، سیستم باید بتواند آن را از یک خطای جدید و بالقوه خطرناک تشخیص دهد.
بنابر گزارش رسانه تخصصی Phoronix، اینتل برای همین منظور مکانیزمی به نام Bitfix Filter در برخی پردازندههای جدید خود در نظر گرفته است. این فیلتر از گزارش مکرر همان خطای تصحیحشده جلوگیری میکند تا سیستم با سیل پیامهای تکراری مواجه نشود. اما یک مشکل دیگر وجود دارد: در سیستمهایی که هفتهها یا ماهها روشن هستند، خطاهای موقتی نیز میتوانند بهتدریج فضای این فیلتر را پر کنند.

اینجاست که BFF یا Bitfix Filter Driver وارد عمل میشود. این درایور لینوکس وضعیت فیلتر را زیر نظر میگیرد و اگر مشخص شود فیلتر پر شده، آن را پاک میکند تا فضای کافی برای ثبت خطاهای جدید و مهمتر باقی بماند. در صورتی که فیلتر خیلی سریع دوباره پر شود، یعنی مثلاً ظرف ۱۰ دقیقه، درایور یک هشدار جدیتر در لاگ سیستم ثبت میکند.
BFF قرار نیست CPU را جوان کند
از دید فنی باید به این حقیقت اذعان کرد که اصولاً اینتل راهی برای کند کردن فرسودگی فیزیکی ترانزیستورها پیدا نکرده است. BFF بیشتر شبیه یک سیستم مراقبت و تشخیص است که کمک میکند پیامدهای پیری سیلیکون بهتر مدیریت شوند.
این رویکرد برای سرورها اهمیت زیادی دارد. در یک کامپیوتر شخصی، بروز خطاهای سختافزاری معمولاً ممکن است به هنگ یا کرش سیستم منجر شود؛ اما در یک دیتاسنتر، حتی یک خطای کوچک میتواند روی سرویسهای در حال اجرا، دادهها و پایداری یک زیرساخت بزرگ اثر بگذارد. به همین دلیل، تشخیص زودهنگام و ثبت دقیق خطاهای سختافزاری بخش مهمی از مدیریت CPUهای سروری است.
فناوری BFF برای کدام پردازندههاست؟
نسخه فعلی درایور BFF برای Xeon 7 Diamond Rapids در نظر گرفته شده است؛ پردازندههای سروری نسل بعدی اینتل که عرضه آنها برای سال ۲۰۲۷ برنامهریزی شده است. پشتیبانی BFF فعلاً به سختافزارهای موجود اینتل مربوط نمیشود و این قابلیت مشخصاً برای پردازندههایی طراحی شده که از Bitfix Filter پشتیبانی میکنند.
در همین رابطه بخوانید:
- پردازنده Xeon 7 جدید اینتل معرفی شد؛ Diamond Rapids با 256 هسته و 1.28 گیگابایت کش
این درایور اکنون در قالب یک وصله نرمافزاری (Patch) برای بررسی در فهرست توسعه هسته لینوکس قرار گرفته و هنوز وارد نسخه پایدار نشده است. با توجه به اینکه Diamond Rapids تا ۲۰۲۷ عرضه نمیشود، توسعهدهندگان لینوکس زمان کافی برای آمادهسازی پشتیبانی کامل از آن دارند.
این تنها رویکرد مقابله با پیری پردازندهها نیست
اینتل پیش از این هم با فناوری In-Field Scan یا IFS سراغ پایش سلامت سیلیکون پردازندههای سروری رفته بود. حالا BFF را میتوان ادامه همین رویکرد دانست. در واقع میتوان گفت که اینتل فقط به عملکرد CPU در روز اول فکر نمیکند و میخواهد در طول سالها کار مداوم در دیتاسنتر، وضعیت و خطاهای آن هم قابل رصد و مدیریت باشد.
در مورد Diamond Rapids، این موضوع اهمیت بیشتری پیدا میکند. قرار نیست CPU فقط سریع باشد و کار کند؛ باید بتواند سالها زیر بار سنگین دوام بیاورد و در صورت بروز خطا، سیستم زودتر متوجه مشکل شود. BFF دقیقاً برای همین سناریو طراحی شده تا خطاهای تکراری سیلیکون، خطاهای مهمتر را زیر خود دفن نکنند.













نظر خود را اضافه کنید.
برای ارسال نظر وارد شوید
ارسال نظر بدون عضویت در سایت