Записи «аппаратно скорректированная ошибка» (Corrected Hardware Error) в средстве просмотра событий Windows с источником WHEA-Logger означают, что процессор, память или контроллер PCIe обнаружили сбой, но смогли исправить его самостоятельно — без зависания и синего экрана. Это не «фантомная» запись: система реально фиксирует аппаратную ошибку, просто механизмы коррекции (ECC, повторная передача пакетов, внутренние проверки четности) справились с последствиями.

Проблема в том, что такие события часто предшествуют более серьёзным сбоям — WHEA_UNCORRECTABLE_ERROR, внезапным перезагрузкам и повреждению данных. Разбираемся, откуда берутся скорректированные ошибки, когда на них стоит реагировать, а когда они являются фоновой нормой, и как безопасно локализовать источник.

Что такое аппаратно скорректированная ошибка

Современные процессоры, модули памяти и шины имеют встроенные механизмы обнаружения и исправления ошибок. Когда бит данных искажается при передаче или хранении, аппаратура может восстановить правильное значение — например, через код коррекции ошибок (ECC) в памяти серверного класса или повторную отправку пакета по шине PCI Express. О каждом таком эпизоде оборудование сообщает операционной системе, и Windows записывает событие через подсистему WHEA (Windows Hardware Error Architecture).

Ключевой момент: слово «скорректированная» описывает результат, а не отсутствие проблемы. Одиночные события за месяцы работы — нормальное явление, особенно на системах с ECC-памятью, где коррекция ошибок является штатной функцией. Тревожный признак — регулярный поток одинаковых ошибок от одного и того же компонента, потому что это указывает на деградацию железа, нестабильное питание или некорректные настройки.

💡

Скорректированная ошибка — это сигнал о реальном аппаратном сбое, который железо успело нейтрализовать. Единичные записи допустимы, повторяющиеся — повод для диагностики.

Где искать эти события в Windows

Откройте средство просмотра событий командой eventvwr.msc и перейдите в раздел Журналы Windows → Система. События аппаратных ошибок имеют источник WHEA-Logger. Дополнительно полезный журнал находится по пути Журналы приложений и служб → Microsoft → Windows → Kernel-WHEA, если он присутствует в вашей версии системы.

По каждому событию смотрите вкладку «Подробности»: там указывается тип ошибки и источник. Типичные варианты:

  • 🔧 Corrected Machine Check — ошибка внутри процессора (кэш, исполнительные блоки), часто связана с разгоном или питанием ядра.
  • 💾 Memory Error — скорректированная ошибка памяти, обычно на системах с ECC.
  • 🔌 PCI Express Root Port / Endpoint — ошибки шины PCIe, возможные виновники: видеокарта, NVMe-накопитель, слот или линии питания.
  • ⚡ Ошибки, появляющиеся под нагрузкой и исчезающие в простое, — классический признак нестабильного напряжения или температуры.
💡

Отфильтруйте журнал по источнику WHEA-Logger и посчитайте частоту событий за неделю. Если записи идут пачками по несколько раз в день — это уже не фон, а симптом.

Типичные причины появления

Возможные причины зависят от типа ошибки, но чаще всего встречаются следующие сценарии. Учтите: это направления для проверки, а не установленный диагноз — подтвердить виновника можно только тестами.

Источник ошибкиВероятная причинаПервичная проверка
Процессор (Machine Check)Разгон, заниженное напряжение ядра, перегревСброс настроек BIOS до заводских
ПамятьНестабильный профиль XMP/EXPO, дефект модуляОтключение XMP, тест памяти
PCIe-устройствоПлохой контакт в слоте, питание видеокарты, накопительПереподключение устройства, проверка кабелей
Блок питанияПросадки напряжения под нагрузкойНаблюдение за ошибками в стресс-тесте
Прошивка/драйверыУстаревший BIOS, конфликт драйверов чипсетаОбновление BIOS и драйверов с сайта производителя

Отдельно стоит упомянуть ноутбуки: там разгон обычно исключён, поэтому повторяющиеся скорректированные ошибки чаще указывают на перегрев из-за забитой системы охлаждения, деградацию памяти или проблемы с NVMe-накопителем. Конкретную причину без диагностики назвать нельзя — начинайте с мониторинга температур под нагрузкой.

⚠️ Внимание: если скорректированные ошибки сопровождаются зависаниями, артефактами изображения или внезапными перезагрузками — прекратите разгон (если он есть) и сделайте резервную копию важных данных до начала экспериментов с железом.

Пошаговая диагностика

Порядок действий построен от безопасных и обратимых проверок к более глубоким. Не меняйте несколько параметров одновременно — иначе не поймёте, что именно помогло.

☑️ Диагностика WHEA-ошибок

Выполнено: 0 / 6

Начните с возврата настроек BIOS к значениям по умолчанию. Профили разгона памяти (XMP, EXPO) — один из самых частых источников нестабильности, даже если система при этом «работает». Если после сброса поток ошибок прекратился, причина найдена: либо профиль слишком агрессивен для вашего экземпляра памяти, либо контроллеру процессора не хватает стабильности на этих частотах.

Далее — тест памяти. Утилита MemTest86, запущенная с загрузочного носителя, проверяет модули вне среды Windows и позволяет выявить дефектные ячейки. Если тест нашёл ошибки на штатных частотах — модуль подлежит замене или проверке по гарантии. При ошибках только на профиле разгона проблема в настройках, а не в «железе».

Для ошибок PCIe полезно физически переустановить видеокарту и накопители: выключите питание, извлеките устройство, осмотрите контакты и слот, установите обратно до фиксации. Окисление контактов и неполная посадка в слот — реальные, хотя и не единственные, причины ошибок шины.

📊 Что стало источником аппаратно скорректированных ошибок в вашей системе?
Разгон или профиль XMP/EXPO
Память
Видеокарта или слот PCIe
Так и не удалось выяснить

Когда ошибки можно игнорировать

Не каждая запись WHEA-Logger требует вмешательства. На серверах и рабочих станциях с ECC-памятью редкие скорректированные ошибки — это штатная работа механизма коррекции, ради которого такая память и используется. Ориентируйтесь на динамику: если количество событий стабильно низкое и не растёт месяцами, система работает нормально.

Другое дело — рост частоты событий. Увеличение числа скорректированных ошибок памяти со временем может указывать на деградацию модуля: ячеек, которые ECC ещё способна исправить, становится больше, и запас прочности тает. В такой ситуации разумно запланировать замену модуля, не дожидаясь нескорректированной ошибки.

Почему ошибки появляются только под нагрузкой

При нагрузке растут температура и ток потребления, а напряжения питания проседают сильнее. Маргинальные участки кристалла или памяти, стабильные в простое, начинают сбоить. Именно поэтому стресс-тесты — эффективный способ воспроизвести проблему, которая «сама по себе» не проявляется.

Чего делать не стоит

Не спешите с рискованными действиями. Прошивка BIOS «на всякий случай», ручная подстройка напряжений, сброс ошибок через сторонние утилиты — всё это способно усугубить ситуацию или замаскировать симптомы без устранения причины. Обновление BIOS оправдано, когда производитель прямо указывает исправления стабильности в описании версии, и выполнять его нужно строго по официальной инструкции для конкретной платы.

⚠️ Внимание: ручное повышение напряжений питания процессора или памяти в попытке «задавить» ошибки может привести к перегреву и ускоренной деградации компонентов. Без понимания безопасных пределов для конкретной платформы такие изменения не выполняйте.

Также не стоит очищать журнал событий и считать проблему решённой: записи — это симптом, а не болезнь. Если после всех безопасных проверок поток ошибок сохраняется, а система работает на гарантии — обращайтесь к продавцу или в авторизованный сервис, сохранив выгрузку журнала как доказательство.

💡

Безопасная последовательность: сброс разгона → обновление ПО → тесты памяти и температур → физическая проверка компонентов → сервис. Рискованные вмешательства — только после исчерпания обратимых шагов.

Частые вопросы

Опасны ли аппаратно скорректированные ошибки для данных?

Само по себе событие означает, что данные были восстановлены корректно, поэтому непосредственной порчи файлов оно не вызвало. Риск в другом: растущий поток таких ошибок повышает вероятность нескорректированного сбоя, который уже может повредить данные или уронить систему.

Может ли виновником быть блок питания?

Да, это возможная причина: просадки и пульсации напряжений под нагрузкой способны вызывать ошибки процессора и PCIe. Подтвердить без лабораторного оборудования сложно — косвенный признак: ошибки возникают именно в пиковые нагрузки и исчезают после замены БП на заведомо исправный.

Ошибки появились после обновления Windows — что делать?

Возможна связь с драйверами чипсета или управлением питанием. Обновите драйверы чипсета с сайта производителя материнской платы или ноутбука и проверьте, сохраняются ли события. Если ошибки появились строго после обновления и их не было раньше — имеет смысл сообщить о проблеме через механизм обратной связи ОС.

Нужно ли менять память, если ECC исправляет ошибки?

Единичные события — нет, это штатный режим работы ECC. Повод для замены — устойчивый рост числа коррекций, ошибки, привязанные к одному модулю, или подтверждённые дефекты в MemTest86 на штатных настройках.

Поможет ли переустановка Windows?

Как правило, нет: скорректированные ошибки генерируются аппаратурой, а не операционной системой. Переустановка оправдана только если есть подозрение на повреждённые драйверы, и то сначала проще обновить их без переустановки системы.