Windows10の突然再起動(BSODなし)を直す|VIDEO_TDR_FAILURE(0x116)・nvlddmkm.sys・NVIDIAドライバーの完全対策

Windows 10 で、作業中でも放置中でも予告なく「ストン」と再起動するのにブルースクリーンが残らない——この症状は、NVIDIA ドライバーと TDR(Timeout Detection and Recovery)の相性で起きることが少なくありません。ここでは VIDEO_TDR_FAILURE(0x116)nvlddmkm.sys を伴うケースを前提に、ドライバーの“逆順検証”から DDU の正しい使い方、電源・BIOS・OS の同時チェック、最終切り分けまで、実務的な手順で徹底解説します。

目次

「突然再起動(BSODなし)」の正体と読み解き方

Windows の TDR は、GPU が一定時間内に応答しないとドライバーをいったん落として再起動し、復帰できなければシステムを巻き添えにして再起動します。ミニダンプやイベントログに VIDEO_TDR_FAILURE(0x116) と、原因モジュール nvlddmkm.sys が並ぶのが典型です。自動再起動が有効だと BSOD を見ないまま再起動するため「エラーが残らない」ように見えます。

前提と再現条件(今回のケース)

  • OS:Windows 10(64bit)
  • GPU:NVIDIA GeForce 系
  • 現象:使用中・待機中に関係なく無予告再起動。ブルースクリーンは表示されない。
  • 解析:ミニダンプに 0x116 / nvlddmkm.sys が複数回。ドライバー署名日 2025/09/05nvlddmkm.sys で発生履歴。
  • 対処履歴:DDU でクリーン→最新ドライバーを入れ直し→数日で再発。

まず押さえる結論(要点)

  • 最新ドライバー=最安定ではない。過去の安定版を「古い順に」試す逆順アプローチが TDR 対策の近道。
  • DDU は セーフモード+オフライン で実行し、再導入後は Windows Update によるドライバー上書きを抑止。
  • ドライバー検証と同時に、温度・電源・BIOS・メモリ・OS健全性 を平行チェックすると再発率が大きく下がる。
  • 一時的な診断として TDR の猶予時間(TdrDelay) を拡大して挙動を観察するのは有効。ただし恒久運用は非推奨。
  • 旧版でも改善しなければ、GPU・電源の劣化 を疑い、別環境での動作検証や代替 GPU での切り分けへ。

NVIDIA ドライバーの「逆順」検証(安定版を見つける最短ルート)

多くの TDR 事例は、同一系統のドライバーでもビルド差で安定度が変わります。ここでは Game Ready ドライバーを例に、最新版から遡って安定版を“見つける”手順を示します。

  1. マニュアル検索で全バージョン一覧を出す:製品ファミリ・OS を指定して一覧を開き、「View More Versions」で旧版まで表示。
  2. ネットワークを切る:インストール中に Windows Update が割り込むのを防ぎます(LAN を抜く/Wi‑Fi をオフ)。
  3. DDU をセーフモードで実行:「GPU を選択 → NVIDIA → クリーン&再起動」。残渣(レジストリ・ドライバーストア・サービス)を完全排除。
  4. 最も古いドライバーから試す:まずは一覧の末尾にある古い Game Ready を導入し、数日の実使用で再現性を確認。
  5. 再発したら一段だけ新しく:同手順で 1 つ新しい版に上げて再検証。「症状が消える版」が見つかるまで段階的に上げます。
  6. 併行候補:同時代の Studio Driver(WHQL)も試すと成功率が上がります。ゲーム重視でなければ選択肢に。

ポイント:今回の解析では nvlddmkm.sys の署名日が 2025/09/05 の版で失敗しているため、目安として 2025年8月以前のドライバーを優先的に検証すると効率的です。

インストーラーの選択(安定志向の構成)

  • セットアップでは カスタム(クリーンインストール) を選択。
  • GeForce Experience・テレメトリ など任意機能は外し、Display Driver + PhysX の最小構成に。
  • 導入直後は 自動更新を止める(後述)。検証が済むまでバージョンを固定。

Windows Update によるドライバー上書きを防ぐ

逆順検証中に Windows Update が別版を当てると結果が崩れます。以下のいずれかで抑止しましょう。

方法手順(要約)備考
設定アプリで一時停止[設定] → [Windows Update] → [詳細オプション] → 更新の一時停止 を最長期間に設定Home/Pro 共通。簡単で確実。
グループポリシー(Pro)[gpedit.msc] → コンピューターの構成 → 管理用テンプレート → Windows コンポーネント → Windows Update → 「ドライバーを含めない」を有効Pro/Enterprise 向け。
レジストリ(Home 可)HKLM\SOFTWARE\Policies\Microsoft\Windows\WindowsUpdateExcludeWUDriversInQualityUpdate(DWORD=1)を作成再起動後に有効。編集は慎重に。

ドライバー以外の同時チェック(再発率を下げる隠れ要因)

チェック項目確認・対処例目安・判断
温度HWiNFO 等で GPU/CPU 温度・クロック・電力をログ。ファン清掃、ケースエアフロー見直し、GPU サーマルパッド/グリス再塗布。GPU 80–85℃越えや 急激な温度段差 は要注意。
電源ユニット(PSU)経年 5 年超の 80PLUS 旧モデルは劣化疑い。アイドル時も再起動するなら 12V の瞬低を疑う。余裕 30% 以上の定格へ。別 PSU を仮挿しで再発が止まるなら交換一択。
マザーボード BIOS最新 BIOS に更新。PCIe 相性・リバーサル関連の修正が入ることあり。既定値へロードしてから必要項目のみ調整。古い BIOS+新 GPU は TDR を誘発しがち。
メモリMemTest86 を 1 夜。XMP/EXPO をいったん無効にして JEDEC へ。エラーが出たスロット・モジュールを特定。1 エラーでも NG。要交換・電圧見直し。
ストレージSMART を確認。NVMe の温度スロットリングや電源管理(ASPM)との相性に注意。不良セクタ・再割当が増加なら交換。
周辺機器USB ハブ・キャプチャ・VR を一旦外す。高負荷時のバス電力不足やドライバー競合を排除。最小構成で再現しないなら周辺が原因。

OS の健全性を整える(SFC / DISM / 既定設定)

ドライバーの土台となる OS が壊れていると、どの版でも安定しません。システムファイルを修復し、ダンプ採取の準備もしておきます。

  1. 自動再起動を一時無効化:「システムのプロパティ → 詳細設定 → 起動と回復 → システムエラー → 自動的に再起動する をオフ」。
  2. ダンプ収集を有効化:「小(256KB)」「または自動メモリダンプ」を選択。ページファイルは OS ドライブにシステム管理で置く。
  3. SFC / DISM: DISM /Online /Cleanup-Image /RestoreHealth sfc /scannow
  4. デバイス マネージャーを整える:表示 → 「非表示のデバイスの表示」をオンにし、古いディスプレイアダプターや重複モニターを削除。

電源・省電力由来の TDR を潰す

  • 電源プラン:[電源オプション] → 高パフォーマンス(またはバランス+カスタム)。
  • PCI Express のリンク状態電源管理:オフ に設定。
  • 高速スタートアップ:コントロールパネル → 電源オプション → 電源ボタンの動作 → 高速スタートアップを無効
  • モニター設定:高リフレッシュ多画面構成は検証中は避け、単一モニター・60Hz で安定性を確認。
  • ブラウザのハードウェアアクセラレーション:検証中は無効化し、動画再生やスクロールでの TDR 再現性を観察。

一時的な診断:TDR の猶予時間を伸ばす

「負荷の谷間でわずかに応答が遅れて落ちる」タイプの環境では、猶予延長で劇的に安定することがあります。恒久対策ではありませんが、ドライバー版の当たりを探す“足場”として有効です。

  1. レジストリ エディタで以下を作成/変更(DWORD/10進): キー: HKLM\SYSTEM\CurrentControlSet\Control\GraphicsDrivers 値: TdrDelay = 10 値: TdrDdiDelay = 20
  2. 再起動後に挙動を観察。これで安定するなら「限界は近いが動ける」状態。根本はドライバー版・電源・温度で解きます。
  3. TdrLevel=0(TDR 無効化)は恒久運用禁止。ハング検知が働かずリスクが跳ね上がります。

ログの取り方(再起動なのか TDR なのかを可視化)

  • イベント ビューアー:
    • [Windows ログ] → [システム] → ID 41(Kernel-Power)、ID 4101(Display driver nvlddmkm …)、WHEA-Logger(17/18/19)を確認。
    • [アプリケーションとサービス ログ] → [Microsoft] → [Windows] → [Diagnostics-Performance] も併せて見る。
  • 信頼性モニター:スタートに「信頼性」と入力 → グラフからクラッシュ時刻のアプリケーション不応答ハードウェア エラーの並びを追う。
  • LiveKernelReports:C:\Windows\LiveKernelReports\WATCHDOGGPU フォルダーに .dmp があれば符号が合うか確認。

ケース指向の対処:署名日 2025/09/05 の nvlddmkm.sys で失敗する

特定のドライバー枝でバグが混入している可能性があります。対処の勘所は以下。

  1. 2025年8月以前の Game Ready を底から順に。1 つ上げて再検証を反復。
  2. 同時代の Studio Driver(WHQL) を並行検証。動画編集・3D・AI 推論などではむしろ安定。
  3. Windows Update 配信の WHQL 版(自動)も候補。意図的にこれを固定して安定させる運用は現実解です。

インストール時の「地雷」を避ける

  • カスタムインストールで HD Audio / USB-C / Shield / Telemetry など不要機能を外す。
  • 導入直後に NVIDIA コントロールパネル → 3D 設定の管理 → 電源管理モード を「優先最高性能」ではなく 最適電力 or アダプティブ に。高負荷アプリはプロファイル個別で「最高性能」へ。
  • オーバークロック・アンダーボルト・電力制限は完全既定に戻して検証。カーブ調整・PL 変更は安定後に実施。

最終切り分け:ハードの故障が疑わしい時

旧版でも改善せず、温度・電源・OS が健全なら、ハードウェアの劣化や製造起因不良を疑います。

  1. 別 PC で GPU を試す:問題が移れば GPU 側、移らなければマザーボード/PSU 側の疑い。
  2. 代替 GPU を挿す:オンボードまたは廉価 GPU に差し替え、同条件で再現するかを検証。
  3. RMA / 交換:保証期間内ならメーカー交換。中古 PSU や経年 PSU は迷わず新品へ。

よくある落とし穴と回避策

落とし穴何が起きるか回避策
DDU を通常モードで実行一部サービスが動作中で残渣が残るセーフモードで実行。インターネットは遮断。
導入後に Windows Update が上書き検証結果が混ざり原因特定不能更新の一時停止・グルポリ・レジストリで上書き禁止
多画面+高リフレッシュで検証帯域・クロック遷移で不安定を誘発単一モニター 60Hz で安定化→徐々に戻す。
ページファイルをゼロにするダンプが採れず解析不能、メモリ不足で落ちやすくOS ドライブにシステム管理サイズで常設。
TdrLevel を無効化したまま運用ハング検知が働かず、固まりっぱなしに診断用のみ。恒久は猶予延長まで。

実行順チェックリスト(コピペ保存用)

1) OS 健全性整備
   - 自動再起動オフ、ダンプ有効、SFC/DISM、ページファイル既定
2) 物理・電源
   - 清掃、温度ログ、PSU 年式と余裕、BIOS 最新・既定ロード
3) 検証の準備
   - ネット遮断、セーフモード起動、DDU で完全削除
4) 逆順ドライバー検証
   - 最古の Game Ready → 再現観察 → 一段上げる(Studio も併走)
   - NVIDIA 設定は最小構成・既定クロック
   - Windows Update 上書き抑止を維持
5) 補助的対処
   - 電源プラン最適化、PCIe 省電力オフ、Fast Startup 無効
   - (診断)TdrDelay=10 / TdrDdiDelay=20
6) 切り分け
   - 別 PSU / 別 PC / 代替 GPU で移るかを見る
   - 移る→GPU 交換、移らない→マザー/PSU を疑う

トラブルが「アイドル中」に多いときの考え方

高負荷よりも待機中に落ちる場合は、クロック遷移(高⇔低)と電力管理の噛み合わせ不良が主因です。電源プランの見直し、モニター消灯・スリープの無効化、スクリーンセーバーを使わない、など「変化点」を減らす設定で改善することがよくあります。さらに、常駐ソフト(オーバーレイ、録画、監視ツール)を極力外し、Windows クリーンブート(MS 以外のサービスを無効)で再現するかを確かめると因果が見えます。

トラブルが「高負荷」に集中するときの考え方

ゲームや GPU 加速アプリでのみ落ちるなら、電力供給と温度マージンが疑わしいです。ケースフロントの吸気強化、GPU のファンカーブ見直し、PSU の 12V 系に余裕のあるモデルへ更新、補助電源ケーブルを別レーンで挿す(デイジーチェーン回避)といった物理対策が効きます。OC 設定を一律オフ(PL/電圧/メモリクロック含む)で“定格”に戻すのも基本です。アンダーボルトは安定化に効くケースもありますが、安定を確認してから、少しずつ試すのが鉄則です。

最小工数で「再起動ループ」を抜けるための運用術

  • 安定版が見つかったら固定:検証が終わるまで更新しない。必要になったらまず 1 つだけ上げて様子見。
  • 復元ポイントを活用:ドライバー導入前後でポイントを作成。復旧が数分で終わります。
  • 変更は 1 回につき 1 つ:「何を変えたら安定したか」を特定できる粒度で進めます。
  • ログを残す:イベント ID、温度ログ、再発日時、操作内容をメモ。原因の相関が見えてきます。

「これだけはやった方がいい」簡易セット

  1. 自動再起動オフ+ダンプ採取有効化。
  2. DDU セーフモード+オフライン → 最小構成ドライバー導入(2025/08 以前から逆順)。
  3. Windows Update のドライバー上書き停止。
  4. 電源プラン最適化、PCIe 省電力オフ、Fast Startup 無効。
  5. 温度・電源・BIOS・メモリの平行チェック。
  6. 改善しなければ別 PSU / 別 PC / 代替 GPU で切り分け、RMA へ。

補足:VIDEO_TDR_FAILURE (0x116) の意味を正しく理解する

このバグチェックは「GPU が指定時間内に応答しないドライバー再起動を試みた復帰できなかった」という流れを示します。黒画面や数秒のフリーズだけで BSOD が残らないのは TDR の挙動そのもの。今回のように nvlddmkm.sys(NVIDIA カーネル ドライバー)が原因に挙がる場合、ドライバー版と電源・温度・PCIe 周りの三点が主要因です。「GPU 世代を変えれば終わり」ではなく、同じ系列の問題ドライバーを入れれば再発する点に注意してください。

FAQ(短答集)

  • Q. DCH 版と Standard 版、どちらが安定?
    A. どちらでも安定する環境が多いですが、既存ソフトやパネル連携の都合で Standard 版が無難なことも。片方で不調ならもう片方を試す価値あり。
  • Q. Game Ready と Studio の違いは?
    A. 前者はゲーム最適化の更新頻度が高く、後者は長めの検証を経た安定志向。クリエイティブ用途や安定優先なら Studio を試すと良いです。
  • Q. ドライバーだけ毎回壊れるのは OS 破損?
    A. OS 側の破損もあり得ます。SFC/DISM とページファイル設定、クリーンブートでの再現確認を。
  • Q. TdrDelay を上げたまま運用していい?
    A. 診断用としては有効ですが恒久は非推奨。根因(ドライバー版・電源・温度)を解き、最終的には既定に戻すのが安全です。

まとめ

最新=最安定ではないという前提に立ち、DDU→古い版からの逆順検証を軸に、Windows Update の上書き抑止電源・温度・BIOS・メモリ・OS 健全性の平行チェックを回す。これが 0x116 / nvlddmkm.sys 起因の予告なし再起動を止める最短ルートです。署名日 2025/09/05 の版で問題が出ているなら、それ以前の版を中心に試し、安定したら固定。改善しない場合は 別 PSU / 代替 GPU / 別 PC で物理切り分けを行い、故障と判断できたら RMA・交換へ。ここまでを順守すれば、多くの環境で再起動ループから抜け出せます。

この記事を書いた人

実務の現場で詰まりがちなポイントを地図にするITブログ「IT trip」を運営。Windows/Office(Teams・Excel)からSQL、サーバ運用、ガジェットまで、再現性のある手順と“なぜそうなるか”を丁寧に解説します。読んだらすぐ試せること、そして迷った人の次の一歩が見えることを大切にしています。

コメント

コメントする

目次