ゲームが20〜60分ほどで突然クラッシュし、イベントビューアには「Event ID 153(nvlddmkm)」や「Kernel‑Event Tracing」「WHEA‑Logger ID 17」の警告が並ぶ——そんな厄介な症状を、原因ごとに切り分けて堅実に直すための実践ガイドです。ドライバーのロールバックからMPO無効化、電源最適化、ページファイル設計、WHEA対策まで、再現しやすい手順と検証方法を徹底的にまとめました。
症状の全体像と前提
本記事の主題は、WindowsのイベントログにEvent ID 153(nvlddmkm)が多数記録され、プレイ開始から20分〜1時間程度でゲームがクラッシュ/フリーズ/デスクトップに戻る問題です。併発しやすいログとして、Kernel‑Event Tracingの警告やWHEA‑Logger ID 17(PCI Express Root Portの訂正済みエラー)が挙がります。
- nvlddmkm.sys:NVIDIA Windows Kernel‑Mode Driver。TDR(Timeout Detection and Recovery)に関与。
- Event ID 153:Storport/ディスクI/Oの応答遅延。I/O処理の待ち(ストレージ、NVMeドライバー、ケーブル/電源、メモリ逼迫)により誘発。
- WHEA‑Logger ID 17:PCIeレイヤで訂正可能なエラーが発生。BIOS設定・チップセット・配線・接点の影響を受けやすい。
以下の手順は上から順に試すことで、原因を切り分けつつ再現性と改善度を評価できます。最短では「ドライバーを旧版(例:2025年初頭の安定版)へロールバック」だけで解決する事例もあります。
なぜ「153」と「nvlddmkm」が同時に出るのか(技術的背景)
ゲームはGPUメモリとシステムメモリ、ストレージI/Oを高頻度で行き来します。I/O遅延やメモリ逼迫が起きると、ページングやアセット読み込みが詰まり、描画スレッドに遅延が伝播し、最終的にGPUドライバーがTDR(ドライバーが一定時間応答しない)としてリセットされることがあります。これがnvlddmkmエラーとEvent ID 153の同時発生を招く典型パターンです。
- ボトルネックの連鎖:NVMeの待ち→ページファイルのスラッシング→描画遅延→TDR。
- 電源やPCIe品質の影響:瞬間的な電圧ドロップやリンク状態の不安定化がWHEA 17やGPUリセットを誘発。
- MPO(Multi‑Plane Overlay):マルチプレーン合成の挙動が一部アプリで不安定化し、点滅/描画停止を引き起こす例。
まずは症状の再現条件を整える(切り分けフレーム)
検証の信用度を高めるため、以下の条件で再現テストを実施します。
| テスト | 狙い | 判定基準 |
|---|---|---|
| クリーンブート(常駐最小化) | 常駐アプリがTDRやI/Oを妨げていないか | 常駐停止で安定化→アプリ側要因の疑い |
| オフライン起動 | クラウド同期やオーバーレイの影響切り分け | オフラインで安定→通信・オーバーレイ要因 |
| 別タイトル/ベンチ(Heaven/OCCT) | ゲーム固有か、システム共通か | 全体で不安定→システム側(ドライバー/電源/PCIe) |
| ウィンドウモード/フルスクリーン切替 | MPOやウィンドウマネージャの影響 | モードで差→MPO/合成系が関与 |
解決フロー(全体像)
| 手順 | 目的/内容 | 補足ポイント | 目安時間 | 難易度 |
|---|---|---|---|---|
| 1. ハードウェア安定性を確認 | GPU:OCCT/FurMark/Heavenで負荷 RAM:MemTest86を数時間〜一晩 SSD/HDD:CrystalDiskInfoでSMART/温度確認 | TDRやI/O遅延の根本原因がハードかを切り分け | 1〜12時間 | 中 |
| 2. GPUドライバーをロールバック | 最新版(例 v581.29)で発生→旧版またはStudioドライバー(例 v572.70、2025年2月頃の安定報告)へ | DDUで完全削除後に導入。プロファイル再設定を推奨 | 30〜60分 | 中 |
| 3. MPOを無効化 | レジストリ:HKLM\SOFTWARE\Microsoft\Windows\Dwm に OverlayTestMode=5 | 点滅/ドライバーリセットの低減事例あり | 5〜10分 | 低 |
| 4. 電源最適化 | Windows電源プランを高パフォーマンス。NVIDIA Control PanelでPrefer Maximum Performance | クロックの揺れ・不足電力によるTDRを回避 | 10分 | 低 |
| 5. ハードウェアアクセラレーションを一時無効 | Chrome/Discord/Steam等のアクセラレーションOFFで再現性を確認 | ゲーム外のGPU呼び出し干渉を排除 | 10〜20分 | 低 |
| 6. PSUと配線点検 | 容量、12VHPWRの差し込み、ライザー回避、個別ケーブル直挿し | ハイエンドGPUは目安750W以上、ケーブルの曲げ半径にも注意 | 15〜30分 | 中 |
| 7. WHEA‑Logger 17 対策 | チップセット/ME FW更新、BIOSでASPM等PCIe省電力OFF、増設カード再装着 | PCIe Root Portの訂正済みエラー多発時に有効 | 20〜40分 | 中 |
| 8. 仮想メモリを固定 | 初期=RAM×1.5、最大=RAM×3 | メモリ逼迫時のI/O遅延を緩和 | 5〜10分 | 低 |
| 9. 高速スタートアップを無効 | 電源オプション > システム設定で高速スタートアップOFF | ドライバー初期化不全の回避 | 3分 | 低 |
| 10. 追加ログを解析 | Critical/WHEA/ディスク系を横断的に点検し対処を追加 | 再現時刻の相関で原因を絞り込む | 30分〜 | 中 |
各ステップの具体手順
1. ハードウェア安定性の確認
- GPU:OCCTの「Power」「3D」やFurMark(温度監視必須)を15〜30分、Heavenベンチをループ。
目安:温度が許容範囲(空冷80℃前後、VRAM 100℃未満)でエラー・描画化けがない。 - RAM:MemTest86をUSB起動し数時間〜一晩。Error=0を確認。
- ストレージ:CrystalDiskInfoで「注意」「代替処理済のセクタ」などを確認。温度が高すぎる場合はエアフロー改善。
この段階でエラーが出る場合は、ソフト的対処よりハード交換・配線の見直しが先決です。
2. NVIDIA ドライバーのロールバック(DDU使用)
- インターネットを一時的に遮断(自動配布防止)。
- DDUでセーフモード起動→既存ドライバーを完全削除。
- 再起動後、安定報告のある旧版またはStudioドライバー(例:v572.70)を手動インストール。
- NVIDIA コントロールパネルの設定(電源、V‑Sync、G‑Sync等)を再構成。
最新版(例:v581.29)で発生するが旧版で安定する場合、ドライバーの挙動差が強く疑われます。
3. MPO(Multi‑Plane Overlay)を無効化
点滅・黒画面・描画停止が伴う場合はMPOが関与することがあります。以下で無効化できます(再起動要)。
reg add "HKLM\SOFTWARE\Microsoft\Windows\Dwm" /v OverlayTestMode /t REG_DWORD /d 5 /f
戻すには値を削除(または0)します。レジストリ編集は自己責任で、事前に復元ポイント作成を推奨します。
4. 電源関連の最適化
- Windows 電源プラン:「コントロール パネル > 電源オプション」で高パフォーマンスを選択。
- 詳細設定:「PCI Express > リンク状態の電源管理」=オフ。
- NVIDIA Control Panel:「Manage 3D settings > Power management mode」=Prefer maximum performance。
省電力の過度な介入によりクロックが揺れると、フレームタイム悪化からTDRへ波及することがあります。
5. ハードウェアアクセラレーションを一時無効
ブラウザやオーバーレイアプリが描画パイプラインに割り込むと不安定化します。再現検証として次をOFFに。
- Chrome/Edge:「設定 > システム」→「ハードウェアアクセラレーションが使用可能な場合は使用」OFF。
- Discord:「設定 > 詳細設定」→「ハードウェア アクセラレーション」OFF。
- Steam/GeForce Experience:オーバーレイを一時無効。
6. PSU(電源)と配線の点検
| 構成の目安 | 推奨PSU容量 | 配線ポイント |
|---|---|---|
| ハイエンドGPU+高TDP CPU | 750W〜1000W | 12VHPWRは直挿し・奥まで確実。分岐ではなく独立ケーブル使用 |
| ミドルレンジ構成 | 650W〜750W | ライザー/延長は一旦外す。ケーブルの急角度曲げに注意 |
瞬間的な電圧降下はドライバーのTDR閾値に影響し、nvlddmkmエラーの直接要因となり得ます。
7. WHEA‑Logger ID 17(PCIe訂正済み)の対処
- チップセット/ME ファームの更新:マザーボードの配布版に更新。
- BIOS 設定:ASPM/L1 Substates等のPCIe省電力を無効、拡張バー(Resizable BAR)はGPUと相性を見て切替。
- 物理層:GPU・メモリ・NVMe・増設カードの抜き差し、接点クリーニング。
WHEA 17がゲームの直前直後に集中するならPCIeレイヤの安定性を最優先で疑います。
8. 仮想メモリ(ページファイル)を固定
- 「システムの詳細設定 > パフォーマンス > 詳細設定 > 仮想メモリ」。
- 「すべてのドライブのページング ファイルのサイズを自動的に管理する」をOFF。
- OSドライブに「カスタム サイズ」:初期=RAM×1.5、最大=RAM×3を目安に設定。
例:RAM 32GBなら初期48GB / 最大96GB。I/O遅延吸収とメモリ逼迫時の安定度が向上します。
9. 高速スタートアップを無効
- 「コントロール パネル > 電源オプション > システム設定」。
- 「現在利用可能ではない設定を変更します」。
- 「高速スタートアップを有効にする(推奨)」のチェックを外す。
起動高速化の副作用でドライバー初期化が不完全になるケースを回避します。
10. 追加ログの取り方(相関で絞り込む)
| ログ | 抽出例 | 狙い |
|---|---|---|
| Event ID 153 | wevtutil qe System /q:"*[System[(EventID=153)]]" /f:text /c:50 | I/O遅延の直近発生を確認 |
| WHEA‑Logger | wevtutil qe System /q:"*[System[Provider[@Name='WHEA-Logger']]]" /f:text /c:50 | PCIeエラーのタイミングを確認 |
| nvlddmkm(Display) | Get-WinEvent -FilterHashtable @{LogName='System'; ProviderName='Display'} | Select -First 50 | TDR/ドライバーリセットの直前後を確認 |
ログの時刻相関(どれが先に出るか)を見れば、原因層(I/O→TDR、PCIe→TDR など)が鮮明になります。
実際の効果例(フィールドノート)
- 旧ドライバーへ戻しただけでクラッシュが解消:質問者および複数報告で、ゲームは安定。以後はKernel‑BootやKernel‑Tracingの警告のみ残存(致命的ではない)。
- 古いノートPCで v581系 → v572.70にダウングレードしTDR消失:MPO無効化・電源最適化の併用で再発なし。
補足:ストレージとNVMeドライバーも要チェック
Event ID 153は「ディスクI/O要求への応答遅延」がトリガーです。NVMe/RAIDドライバーやSSDファームウェア、サーマルスロットリング(発熱)、バックグラウンドの大容量コピー/同期が影響することがあります。ゲーム用SSDは空き容量20%以上、発熱が高い環境ではヒートシンクやエアフローを改善しましょう。
よくある質問(FAQ)
Q. Studioドライバーはゲームでも問題ありませんか? A. 多くの環境で安定性が高いケースがあります。最新Game Readyで不具合が続く場合の有力な代替です。 Q. TDRのレジストリ閾値を上げれば直りますか? A. 一時的な回避にはなり得ますが、根本原因(I/O遅延、電源、ドライバー)を解かないと再発しがちです。本記事の手順で先に環境を健全化してください。 Q. HAGS(ハードウェアGPUスケジューリング)はON/OFFどちらが良い? A. 環境依存です。再現検証としてON/OFF双方を試す価値があります。 Q. Kernel‑Event Tracingの警告は無視して良い? A. 致命傷でないケースが多いですが、クラッシュ時刻と重なるなら関連性を疑い、オーバーレイ無効化やMPO無効化を試してください。
チェックリスト(作業前/後)
- [ ] GPU/CPU/VRAM温度は許容範囲か(負荷テスト済み)
- [ ] DDUでクリーンに旧版/Studioドライバーへ切替
- [ ] MPO無効化(必要時)→再起動→再現確認
- [ ] Windows高パフォーマンス+NVCP最大パフォーマンス
- [ ] ブラウザ・Discord・オーバーレイのハードウェアアクセラレーションOFFで検証
- [ ] PSU容量・ケーブル・ライザー・12VHPWRの差し込み点検
- [ ] WHEA 17が減ったか(PCIe省電力OFF/BIOS更新後)
- [ ] ページファイル固定(初期=RAM×1.5、最大=RAM×3)
- [ ] 高速スタートアップ無効化
- [ ] 再発時のイベント時刻相関を取得(153→nvlddmkm→WHEA等)
トラブルシュート・コマンド集(PowerShell/コマンド)
# 直近のnvlddmkm関連(Display)イベント
Get-WinEvent -FilterHashtable @{LogName='System'; ProviderName='Display'} |
Select TimeCreated, Id, LevelDisplayName, Message | Select -First 50
# Event ID 153 の抽出
wevtutil qe System /q:"*[System[(EventID=153)]]" /f:text /c:50
# WHEA-Logger の抽出
wevtutil qe System /q:"*[System[Provider[@Name='WHEA-Logger']]]" /f:text /c:50
# インストール済みGPUドライバーのバージョン確認(代表例)
wmic path win32_VideoController get Name, DriverVersion
安全に元へ戻す(ロールバック手順まとめ)
- MPO:
HKLM\...\Dwm\OverlayTestModeを削除または0に。 - 電源設定:「バランス」に戻し、PCIeリンク状態を「中/最大電源節約」に。
- ページファイル:「自動管理」をONに戻す。
- HAGS/オーバーレイ:元の設定に復帰(再現性の差を記録)。
症状別・優先度早見表
| 兆候 | 優先ステップ | 補足 |
|---|---|---|
| クラッシュ直前に書き込み音、読み込み待ち | ページファイル固定、NVMe/SSD点検、ドライバー見直し | Event 153が連発しやすい |
| 高負荷でのみブラックアウト | 電源最適化、PSU/ケーブル、GPUドライバーの分岐検証 | WHEA 17やTDRが同時発生 |
| ウィンドウ切替で点滅・フリーズ | MPO無効化、アクセラレーションOFF、オーバーレイ停止 | 合成系(DWM)との相性 |
結論:順に試せば高確率で安定化できる
Event ID 153(nvlddmkm)問題は、I/O遅延・ドライバー・電源・PCIe・合成系のいずれか、もしくは複合要因で起きます。まずはドライバーのロールバックとMPO無効化+電源最適化をセットで実施し、次にWHEA 17対策とページファイル設計で底上げを図りましょう。最後にログの時刻相関で原因層を確定すれば、再発防止の再現性が高まります。
付録:テンプレ(相談時に添付すると捗る)
【PC構成】CPU / GPU(VBIOS)/ マザボ(BIOS)/ RAM(型番・本数・XMP)/
【ストレージ】OS用 / ゲーム用 / 空き容量 / SMART
【PSU・配線】容量 / ケーブル本数 / ライザー有無 / 12VHPWR
【OS】Windowsビルド / HAGS / 高速スタートアップ / 電源プラン
【GPUドライバー】バージョン / DDU実施有無 / Studio or Game Ready
【再現条件】タイトル / API(DX11/12/Vulkan)/ 画面モード / 時間帯 / 常駐アプリ
【イベントログ】153 / WHEA 17 / Display(nvlddmkm)直近3件の時刻
【試したこと】MPO / ページファイル / オーバーレイ / BIOS設定 等
最後に:本記事の要点(短縮版)
- 「153+nvlddmkm」はI/O遅延→TDRの連鎖が典型。
- 旧版/Studioドライバーへロールバックで解決する例は多い。
- MPO無効化・電源最適化・WHEA 17対策・ページファイル固定で安定度を底上げ。
- ログの時刻相関を見れば原因層が明確になる。
コマンド・レジストリ操作まとめ
MPO無効化
reg add "HKLM\SOFTWARE\Microsoft\Windows\Dwm" /v OverlayTestMode /t REG_DWORD /d 5 /f
MPOを元に戻す
reg delete "HKLM\SOFTWARE\Microsoft\Windows\Dwm" /v OverlayTestMode /f
イベント抽出(直近50件)
wevtutil qe System /q:"*[System[(EventID=153)]]" /f:text /c:50
wevtutil qe System /q:"*[System[Provider[@Name='WHEA-Logger']]]" /f:text /c:50
対策と効果の対応早見表
| 対策 | 期待できる効果 | 副作用・注意点 |
|---|---|---|
| ドライバーを旧版/Studioへ | 相性起因のTDRが低減 | 新機能や最適化が一部使えない可能性 |
| MPO無効化 | 点滅・黒画面・描画停止の減少 | 一部アプリで合成品質の変化 |
| 電源最適化(Windows/NVCP) | クロック安定・シェーダ突発負荷に強くなる | 待機時の消費電力増加 |
| WHEA 17対策(BIOS/配線) | PCIe経路の安定化、訂正済みエラーの減少 | 省電力機能の一部が無効化される |
| ページファイル固定 | I/O遅延時のクラッシュ耐性が上がる | SSD容量の消費増 |
| 高速スタートアップ無効 | ドライバー初期化不全の回避 | 起動時間のわずかな増加 |
実践メモ:細かなコツ
- GPUの電源リミットや電圧を弄っている場合は標準に戻して検証。
- VRR(G‑Sync/FreeSync)とV‑Syncの組み合わせは、ゲームごとに再現性を見て最適化。
- ゲームフォルダやシェーダキャッシュは、アップデートの節目で再生成(バックアップ推奨)。
- バックグラウンドの大容量同期(OneDrive等)はプレイ中は一時停止。
- OSやBIOS更新後は完全シャットダウン(Shift+終了)→コールドブートで初期化。
この記事の核(要点再掲)
手順を飛ばさず順番に――これが最短解決の近道です。特に「ドライバー旧版+MPO無効+電源最適化」は即効性が高く、続けて「WHEA 17対策」「ページファイル固定」で底力を上げ、最後はログの相関で原因を固定化します。これで多くの環境で、長時間プレイ時のクラッシュが収束します。

コメント