VIDEO_TDR_FAILUREとnvlddmkm.sysで発生するブラックスクリーン・BSODの原因と対処法【NVIDIA GPU/Windows11対応】

動画を見ているだけなのに突然画面が真っ黒になり、そのまま自動再起動や「VIDEO_TDR_FAILURE」「nvlddmkm.sys」のブルースクリーンが出てしまう――。本記事では、そんな症状に悩む Windows PC ユーザー向けに、原因の考え方から具体的な切り分け手順、安定動作させるための設定例までをまとめて解説します。

目次

症状の特徴整理:ゲーム中ではなく「軽い作業中」に落ちる

まずは、典型的な症状を整理しておきます。今回よくあるパターンは次のようなものです。

項目よくある状態
発生タイミング動画視聴(YouTube、配信サイト)、Webブラウジング、ゲーム終了直後のアイドル時
画面の状態いきなり真っ黒(ブラックスクリーン)になり、マウスもキーボードも反応しないか、数秒止まったあとに再起動
ブルースクリーンエラーVIDEO_TDR_FAILURE、原因モジュールが nvlddmkm.sys と表示される
発生頻度1日に数回~数日に1回程度。連続して起きる場合もある
交換済みパーツGPU・マザーボード・PSU・CPU・RAM など構成一式を新品にしても再発するケースがある

ここまで読むと「全部新品なのに壊れているはずがない、じゃあ Windows かドライバか?」と感じるはずです。結論から言うと、この症状パターンでは多くの場合「NVIDIA ドライバ周りの TDR(Timeout Detection & Recovery)失敗」が主因になります。

VIDEO_TDR_FAILURE (nvlddmkm.sys) とは何か

VIDEO_TDR_FAILURE は、Windows が備えている「TDR(Timeout Detection & Recovery)」という仕組みがうまく働かなかった時に出るエラーです。

  • TDR 自体は「GPU が一定時間応答しなくなったらドライバをリセットして復帰を試みる」安全装置
  • その復帰処理に失敗するとブルースクリーンになり、VIDEO_TDR_FAILURE が表示される
  • 原因モジュールが nvlddmkm.sys の場合、NVIDIA のディスプレイドライバ(カーネル側)がハング/クラッシュしている

つまりこの BSOD は、

  • GPU チップや VRAM が物理的に壊れている
  • ドライバや OS のバグで応答が返ってこない
  • 省電力や VRR、DisplayPort の再ネゴシエーションなどでタイミングがズレ、ドライバが「取り残された」状態になる

といった「GPU が一定時間応答できない状況全般」を指しており、イコール=ハードウェア故障とは限りません。新品に一式交換しても再発するケースは、まさにソフトウェア/電源管理の組み合わせが悪さをしている典型例です。

なぜ「軽い作業中」や「ゲーム終了直後」に落ちやすいのか

多くの人が疑問に思うのが、

  • 高負荷のゲーム中では症状が出ないのに、ブラウザで動画を見ているときにだけ落ちる
  • ゲームを終了してデスクトップに戻った瞬間や、その数分後のアイドル時にだけブラックスクリーンになる

という点です。これは、以下の要素が重なりやすいタイミングだからです。

状況内部で起きていること
アイドル時・軽負荷時GPU の P-state が低クロック・低電圧に遷移し、PCIe リンクも省電力モードに入る
動画再生・スクロールフレームレート変動、VRR(G-SYNC / FreeSync)、ブラウザ側のハードウェアアクセラレーションが頻繁に ON/OFF
DisplayPort 利用時スリープ復帰やリフレッシュレート変更のたびにリンク再ネゴシエーションが行われる

これらが噛み合わないと、

  • ドライバは「省電力に落としたい」
  • OS やアプリは「でもフレームは描画してほしい」
  • DP ケーブルやモニタは「リンクを張り直したい」

といった状態になり、一瞬だけ GPU からの応答が完全に途切れることがあります。その瞬間に TDR のタイマーが発動し、復帰できなければ VIDEO_TDR_FAILURE に直行、という流れです。

最優先で試すソフトウェア側の対処

ハード一式が新品でも起きる、という前提なら、まず徹底的にソフトウェア側を疑います。特に次の 6 つは、再現例の多い「効きやすい」対処です。

手順内容狙い
① ドライバのクリーン再インストールDDU で NVIDIA ドライバを完全削除し、安定版ドライバ(Studio または 1~2 世代前)を新規導入する壊れたプロファイルや古い設定ファイル、残存レジストリを一掃する
② HAGS を無効化設定 > システム > ディスプレイ > グラフィック から「ハードウェア アクセラレータによる GPU スケジューリング」をオフGPU スケジューラーを簡素化し、タイミング競合を減らす
③ リンク状態電源管理をオフ電源オプション > PCI Express > リンク状態電源管理 を「オフ」に設定PCIe リンクの省電力遷移を止め、GPU との通信切断リスクを下げる
④ 電源プランを高パフォーマンスに電源プランを「バランス」から「高パフォーマンス」または AMD/RTX 最適化プランへ変更CPU/GPU のクロックや電圧変動を抑え、アイドル時の落ち込みを防ぐ
⑤ G-SYNC / FreeSync / VRR を停止NVIDIA コントロールパネルやモニタの OSD から VRR を無効化し、固定リフレッシュレートにするフレームレートとリフレッシュレートの同期処理を簡略化し、表示パスを安定させる
⑥ TDR 待機時間を延長レジストリの GraphicsDrivers に TdrDelay を追加して 10 秒程度に延長一瞬の応答途切れで即 BSOD にならないよう猶予を増やす(根本解決ではない)

ここからは、それぞれの手順を具体的に掘り下げていきます。

NVIDIA ドライバを DDU でクリーンインストールする

単純な「上書きインストール」では、古い設定ファイルやレジストリが残ったままになりがちです。一度完全に削除してから入れ直すことで、謎の不具合が嘘のように消えることがあります。

  1. あらかじめ NVIDIA 公式サイトから、1~2 世代前の安定していたバージョン(できれば Studio ドライバ)をダウンロードしておく
  2. DDU(Display Driver Uninstaller)を入手しておき、インターネット接続を切断
  3. Windows をセーフモードで起動する
  4. DDU を実行し、「NVIDIA ドライバーを削除して再起動」を実行
  5. 再起動後、Windows が勝手にドライバを当てないように注意しつつ、事前に用意したドライバをインストール
  6. インストール時は「カスタム」を選び、「クリーンインストールを実行」にチェックを入れる

これで、壊れたプロファイルや古い残骸を一掃した状態でドライバを入れ直すことができます。これだけで BSOD がピタリと止まるケースも少なくありません。

HAGS(ハードウェア アクセラレータによる GPU スケジューリング)を無効化

HAGS はパフォーマンス向上を狙った比較的新しい機能ですが、

  • 特定のゲームやアプリ
  • NVIDIA ドライバの特定バージョン
  • マルチディスプレイ環境

との組み合わせによって不安定になる報告が多く、BSOD やブラックスクリーンの常連原因でもあります。

無効化手順の一例は以下の通りです(Windows 11 の場合)。

  1. 設定を開く
  2. 「システム」 > 「ディスプレイ」 > 「グラフィック」 を開く
  3. 「ハードウェア アクセラレータによる GPU スケジューリング」を「オフ」にする
  4. PC を再起動する

HAGS を切るだけで 3 日以上安定した、という例もあり、まず試す価値の高い設定変更です。

PCI Express のリンク状態電源管理をオフにする

リンク状態電源管理は、PCIe スロットの省電力機能です。アイドル時にリンク速度を落としたり、一時的にリンクを切断したりしますが、ここが GPU との通信断 → TDR 発動 のトリガーになることがあります。

オフにする手順は次の通りです。

  1. コントロールパネルから「電源オプション」を開く
  2. 使用中の電源プランで「プラン設定の変更」 > 「詳細な電源設定の変更」をクリック
  3. 項目一覧の中から「PCI Express」 > 「リンク状態の電源管理」を探す
  4. 「バッテリ駆動」「電源に接続」の両方を「オフ」に設定(デスクトップなら一つだけの場合もある)
  5. OK を押して保存し、再起動

これにより、GPU がアイドルに落ち込むタイミングでも PCIe 通信が安定しやすくなります。

電源プランを「高パフォーマンス」系に固定する

「バランス」プランは、アイドル時に積極的にクロックや電圧を落とします。通常は問題ありませんが、

  • 高リフレッシュレート(144Hz~)
  • G-SYNC / FreeSync / VRR
  • ブラウザのハードウェアアクセラレーション

などと組み合わせると、負荷が軽いのに描画頻度はそこそこ高いという中途半端な状態になり、電源管理との相性が悪くなることがあります。

そのため、検証中は以下のような設定にしてみてください。

  • 電源プランを「高パフォーマンス」に変更
  • ゲーミング向けマザーボードや GPU が用意する独自の「高パフォーマンス」または「最適化」プランでも可
  • CPU の最小プロセッサ状態を 100% に固定するのも一つの手(温度と消費電力は上がるので様子を見ながら)

G-SYNC / FreeSync / VRR を一度すべて切る

可変リフレッシュレート(VRR)は非常に便利ですが、

  • モニタの実装
  • ケーブル品質
  • ドライババージョン

のどれか一つでも相性が悪いと、それだけでブラックスクリーンやフリッカーの原因になります。トラブルシューティング中は、

  • NVIDIA コントロールパネルから G-SYNC を無効化
  • モニタの OSD で FreeSync / Adaptive-Sync をオフ
  • リフレッシュレートを 60Hz か 120Hz など、固定値に設定

とし、あえて昔ながらの固定リフレッシュ環境に戻して安定性を確認するのがおすすめです。

TdrDelay を変更して TDR を「待たせてみる」

レジストリ変更は慎重さが必要ですが、一時的な回避策として TDR のタイムアウト時間を延ばす方法もあります。

  1. regedit でレジストリエディタを起動
  2. HKEY_LOCAL_MACHINE\SYSTEM\CurrentControlSet\Control\GraphicsDrivers を開く
  3. 右ペインで右クリックし、「新規」 > 「DWORD (32 ビット) 値」を選ぶ
  4. 名前を TdrDelay とし、値を「10」(10 秒)などに設定
  5. PC を再起動する

これにより、GPU が一瞬固まっても、10 秒以内に復帰できれば BSOD にはならずに済むようになります。ただし、

  • 根本原因(ドライバや電源管理の相性)が解決したわけではない
  • 本来 BSOD になっていた「本物のハングアップ」も無理に生かしてしまう可能性がある

ため、最終手段・一時的緩和策として扱い、本質的な対処とセットで使うことをおすすめします。

同時に進めたいハードウェア側の確認

ソフトウェアの対処と並行して、ハードウェア側も「簡単にできるチェック」から潰していきましょう。

チェック項目内容ポイント
DP / HDMI ケーブル別メーカー・別規格(DP1.4、HDMI2.0/2.1 など)のケーブルに交換細すぎるケーブルや古いケーブルは、VRR や高リフレッシュで不安定になりがち
モニタのファームウェアメーカー公式のアップデートツールがあれば適用VRR 周りの不具合が FW 更新で改善した例も多い
別の PCIe スロットマザーボードに複数の x16 スロットがある場合、別スロットで動作確認スロット自体の接触不良やレーン不良を切り分けできる
別 PC で GPU をテスト友人や職場など、別環境に GPU を挿して同様の負荷をかける別 PC でも VIDEO_TDR_FAILURE が出るなら GPU 側の初期不良が濃厚
PSU(電源ユニット)12V ラインの電圧をモニタリング(ソフト+できればマルチメータ)急激な電圧ドロップやノイズがあると、アイドルからの負荷変動で落ちやすくなる
メモリテストMemTest86 等を数パス実行GPU 不具合に見えて実はメモリエラー、というケースもある
温度GPU/CPU/VRM 温度をモニタリングツールでチェック温度が高すぎてクロックが暴れると TDR のトリガーになり得る

特にGPU を別 PC で検証するのは、

  • 自分の環境固有の問題なのか
  • GPU 単体の問題なのか

を一発で切り分けられるため、非常に有効です。

BIOS・チップセットドライバ更新後に再発した場合の考え方

「HAGS とリンク状態電源管理をオフにしたら 3 日間安定していたが、BIOS と AMD チップセットドライバを更新したら再発した」というパターンは、

  • 新しい BIOS やチップセットドライバで、電源管理の挙動が微妙に変わった
  • その結果、これまでギリギリ耐えていた組み合わせが、TDR 発動コースに入るようになった

という可能性が高いです。

更新直後に行いたい基本手順

BIOS 更新後は、次のようなフローを踏むのがおすすめです。

  1. CMOS クリアを行い、BIOS 設定を完全リセットする
  2. 最小構成(CPU、1 枚の RAM、GPU、システム SSD のみ)で起動し、問題がないか確認
  3. BIOS で「最適化されたデフォルト」ロード後、必要最小限の設定だけ変更する(XMP/EXPO など)
  4. Windows に入ったら、チップセットドライバを改めてインストールし直す

これにより、旧 BIOS 時代の設定が中途半端に残っていておかしな挙動をしている、という状態を避けられます。

一つ前の安定版 BIOS にロールバックする判断

もし、

  • 新 BIOS でのみ VIDEO_TDR_FAILURE が頻発する
  • 旧 BIOS に戻すと症状が大きく減る、または消える

という状況なら、しばらくは旧 BIOS を使うのも立派な選択肢です。BIOS は常に「新しいほど正義」ではなく、特定 GPU・特定 OS・特定世代 CPU の組み合わせでだけ不具合が出ることも珍しくありません。

ただし、BIOS のロールバックはリスクも伴うため、

  • マザーボードのマニュアルに従う
  • 停電リスクの少ないタイミングで実施する
  • USB メモリやデュアル BIOS 機能など、メーカー推奨手順に沿う

といった基本的な注意は守ってください。

原因の切り分け:どこまでやれば「何のせい」と言えるか

ここまでの対処を進めた結果から、どの要因が濃厚かを判断するための目安を表にまとめます。

状況判定の目安次の一手
① DDU でドライバ入れ直し+HAGS・リンク状態電源管理オフで安定ドライバと電源管理の相性・設定が主因の可能性が高いその組み合わせをベースラインとして運用。以後のアップデートは慎重に
② 上記をすべて実施しても、別のバージョンのドライバでも BSOD が続くGPU かマザーボード(PCIe レーン)、PSU などハード側の問題が疑わしいGPU を別 PC で検証、別 PSU や別 PCIe スロットでの動作確認
③ 自分の PC では落ちるが、GPU を別 PC で使うと一切問題なしマザーボードの PCIe 周り、BIOS の相性、電源の質など「自分の環境固有」の要因が濃厚BIOS を一つ前の安定版へ戻す、マザボの RMA を検討
④ モニタやケーブルを変えたら症状が激減または消えたDisplayPort ケーブル/モニタ側の VRR 実装がトリガーだった可能性その組み合わせを常用し、古いケーブルやモニタはサブ用途に回す
⑤ TdrDelay を延長すると BSOD は出ないが、一瞬画面が固まる依然として一瞬のハングは発生しているが、タイムアウト猶予で誤魔化している状態あくまで緩和策と割り切り、根本原因となるドライバ/電源管理/ハードの改善を続ける

このように、「どの操作で安定し、どの状態で再発するか」を記録しておくと、原因候補をだいぶ絞り込めます。

検証ログを残すと、あとで振り返りやすい

闇雲に設定を変えていると「結局どれが効いたのか」が分からなくなります。簡単なもので構わないので、検証ログを残しておくと便利です。

日付変更した設定・作業内容テスト内容結果メモ
2025/xx/xxHAGS オフ、リンク状態電源管理オフYouTube 連続再生 2 時間+ゲーム 1 時間ブラックスクリーンなし一時的に安定した
2025/xx/xxBIOS 更新(バージョン xxxx → yyyy)同上動画視聴中に 2 回 BSOD更新直後に再発
2025/xx/xxドライバを Studio 版の zzzz に変更同上1 週間 BSOD なし現時点の安定構成候補

こうした記録があれば、

  • 自分で「この組み合わせは危険」と判断しやすい
  • サポート窓口やショップに相談する際、「ここまで試した」と具体的に伝えられる

というメリットがあります。

よくある質問と考え方

Q. GPU や PSU、マザボも全部新品なのに、まだドライバや Windows が悪いんですか?

A. はい、その可能性は普通にあります。むしろ最近のトラブルでは、

  • 新しい機能(HAGS、Resizable BAR、VRR など)
  • 新アーキテクチャ GPU とマザボ/チップセットの組み合わせ
  • Windows 10/11 のアップデート

の「微妙な噛み合わせ」によって、ハード自体は健康でも BSOD が出るパターンが増えています。一式新品=ソフト側は完璧ではありません。

Q. Windows のクリーンインストールはした方が良いですか?

A. 他の対処を一通り試しても改善しない場合、クリーンインストールは強力な切り札になります。特に、

  • 何世代にもわたってアップグレードを繰り返した環境
  • 古いドライバやチューニングツールを何度も入れ替えてきた環境

では、レジストリや設定が複雑に絡み合っていることが多いため、いったん真っさらな状態から構築し直すと症状が消えることがあります。とはいえ手間も大きいので、DDU や HAGS 無効化などを試した後の最終手段とするのがよいでしょう。

Q. TdrDelay を大きくしてしまえばすべて解決しますか?

A. いいえ。TdrDelay の延長はあくまで「猶予時間を増やしているだけ」であり、

  • ドライバや電源管理の問題は残ったまま
  • 本当に GPU が固まっている場合は、画面だけが長時間フリーズする

という副作用もあります。根本原因がソフト側にある場合でも、基本は「安定したドライバ+適切な電源設定」で問題を起こさない構成を作ることを目指してください。

まとめ:省電力機能を抑えつつ、安定版ドライバと BIOS を組み合わせる

VIDEO_TDR_FAILURE(nvlddmkm.sys)によるブラックスクリーン/BSOD は、メッセージだけ見ると「GPU が死んだ」と感じがちですが、実際には以下のような要因の組み合わせで発生することがほとんどです。

  • NVIDIA ドライバのバグや特定バージョンの相性
  • HAGS や VRR、PCIe リンク状態電源管理など、電源関連・描画経路の複雑化
  • BIOS やチップセットドライバ更新による挙動の変化
  • DisplayPort ケーブル/モニタ側の実装差

そのため、次のような順番で対処を進めるのが現実的なアプローチです。

  1. DDU で NVIDIA ドライバを完全削除し、安定版(Studio や 1~2 世代前)をクリーンインストール
  2. HAGS、PCIe リンク状態電源管理、VRR といった機能をいったんすべて無効化する
  3. 電源プランを高パフォーマンス系に変更し、アイドル時のクロック落ち込みを抑える
  4. DP/HDMI ケーブル、モニタ、PCIe スロットを変えつつ、GPU を別 PC でもテストする
  5. BIOS とチップセットドライバを「安定していたバージョン」に固定する
  6. どうしてもたまに固まる場合、TdrDelay 延長で BSOD への落ち込みを緩和する

この一連の作業を通じて、

  • 特定の設定やドライバで安定するなら「ソフトウェアもしくは電源管理の競合」
  • どの設定でも別 PC でも落ちるなら「GPU の初期不良」
  • 別 PC では安定するなら「マザボや BIOS、電源など環境固有の相性問題」

というように、原因をかなり明確に絞り込むことができます。

VIDEO_TDR_FAILURE は、「GPU が一定時間応答しなかった」という結果を教えてくれるだけで、犯人が誰かまでは教えてくれません。だからこそ、電源管理と VRR、省電力機能を一度シンプルに戻し、安定版ドライバと BIOS に縛るという原点回帰のアプローチが、遠回りなようでいて結局はいちばんの近道になります。

ブラックスクリーンや BSOD が収まったら、その状態をひとまず「完成形」として保存し、今後のアップデートは慎重に、1 つずつ変えては様子を見る――これを繰り返すことで、安定した GPU 環境を長く維持できるはずです。

この記事を書いた人

実務の現場で詰まりがちなポイントを地図にするITブログ「IT trip」を運営。Windows/Office(Teams・Excel)からSQL、サーバ運用、ガジェットまで、再現性のある手順と“なぜそうなるか”を丁寧に解説します。読んだらすぐ試せること、そして迷った人の次の一歩が見えることを大切にしています。

コメント

コメントする

目次