総説 / NARRATIVE REVIEW

脳損傷者の自動車運転再開評価および
介入に関する国内研究ナラティブレビュー

― 外的基準と介入手法の整理 ―

脳卒中や脳外傷のあと、また車を運転してよいか。この判断を支えるために、日本ではどんな研究が積み上がってきたのか。2015〜2025 年の国内 38 論文を、「何をもって“運転できる”と判定したか(外的基準)」という一点で串刺しに整理したレビューです。

38組み入れ論文
33評価研究
5介入研究
7外的基準の型
2015–25検索対象年
01 — INTRODUCTION

まず、この研究が何を問題にしているか

ひとことで言うと:「この人は運転できます」と言うためには、何かと照らし合わせて確かめる必要があります。その“照らし合わせる相手”=外的基準が弱いままだと、いくら検査のカットオフ値を精密に出しても、土台が揺らいでしまう。──このレビューは、国内研究のその土台部分を点検したものです。

脳損傷後の運転再開は社会参加や地域生活への復帰と結びついており(Finestone ら 2010)、リハビリテーション医学における重要な課題です。臨床では神経心理学的検査、スクリーニング検査、ドライビングシミュレータ(DS)、実車評価が用いられ、その結果をもとに訓練や介入が行われます。しかし、それぞれの位置づけや実施時期について統一した合意はなく、評価から介入までを含む支援体系は十分に確立されていません。

海外ではランダム化比較試験やメタアナリシスを含むシステマティックレビューが報告されています(Hwang ら 2023)。ただし、その知見を日本の臨床にそのまま持ち込むには注意が必要です。免許制度や交通法規が異なるだけでなく、SDSA や TMT には日本版が作成され、海外とは異なる国内データに基づく基準値も提案されています。国内の DS は日本の交通環境・法規を前提に設計されており、評価方法の構造も解釈基準も国際的なものとは異なります。

国内の代表的レビューとして、加藤らが実車評価を外的基準とした神経心理学的評価のシステマティックレビューを行い、TMT や SDSA が運転技能と関連しうることを報告しています(加藤ら 2016a)。ただし組み入れ研究の多くは海外研究で、当時の国内エビデンスは限られ、収載は 2015 年まででした。その後、国内でも研究が徐々に蓄積してきましたが、対象者・評価方法・外的基準・介入手法のばらつきが大きく、全体像を把握しにくい状況が続いています。

このレビューの二つの視点

検索の方法

医中誌 Web と PubMed を用い、2015〜2025 年に発表された文献を検索(最終検索日 2026 年 1 月 6 日)。医中誌の検索式は「(脳卒中 OR 高次脳機能障害 OR 脳損傷)AND 運転 AND(評価 OR 介入 OR 支援)」。PubMed では英語論文を網羅するため “Japan OR Japanese” を加えています。会議録・症例報告は除外し、参考文献リストからのハンドサーチも併用。報告の質を担保するため SANRA(ナラティブレビューの質評価尺度)を用いた自己評価を行っています。

02 — OVERVIEW

244 件から 38 件へ

データベース検索で同定した 244 件を、タイトル・抄録スクリーニングと全文精査を経て 38 件に絞り込んでいます(図 1 に対応)。

244
同定された記録
医中誌 Web + PubMed(2015–2025)
スクリーニング
タイトル・抄録
会議録・症例報告・国外研究を除外
全文精査
定義への適合を確認
参考文献のハンドサーチを併用
38
最終組み入れ
評価 33 件 + 介入 5 件

内訳を外的基準で見ると

クリックすると、その基準を使った研究に絞り込んだ一覧へ移動します。

読みどころ:評価研究 33 件のうち、実車評価・公安委員会判断・実運転・事故という「現実に近い」アウトカムを使ったのは 24 件。残る 9 件は代替指標(J-SDSA や DS の合否)または医療者判断を基準にしています。レビューは後者を「妥当性に限界がある」と明確に位置づけています。
03 — EXTERNAL CRITERIA

外的基準の妥当性マップ

このレビューの背骨にあたる部分です。7 つの外的基準を「現実の運転行動からの距離」で並べ、それぞれの臨床的意義と、研究上の限界を対にして示します(表 2 に対応)。

← 代理的・間接的現実の安全性に近い →

※ 原著の表 1 では「実運転行動」を一つの区分としてまとめています。本ページでは表 2 の 6 区分に沿い、 事故・違反を直接アウトカムとした研究(武原ら 2016、寺尾ら 2023)を「事故・違反」として分けて表示しています。

なぜ「循環性」が問題になるのか

医療者判断を外的基準にすると、予測因子(神経心理学的検査の点数)と外的基準(その点数を見て下した判断)が、同じ情報から作られてしまいます。これは評価構造の循環性であり、独立した検証にはなりません(Luchetti 2024)。公安委員会の最終判断も、医療機関の意見書や診断書に依拠する場合には同じ問題を完全には排除できません。

一方で、より現実に近い基準にも固有の限界があります。実車評価は標準化・再現性に課題があり(Bellagamba ら 2020)、実運転再開は「再開したこと」を示すだけで安全性を保証しません。事故・違反は安全性を最も直接反映しますが、発生頻度が低く統計的検出力に制約があり、自己申告では過少報告されやすい(Finestone ら 2011)。交通環境や運転頻度の影響も受けます(Ahmad ら 2021)。

「臨床的に有用な指標であっても、研究上の妥当性の観点からは限界を有する場合がある」──表 2 の注記より
04 — STUDIES

38 論文を探す

各カードを開くと、その研究が「何を外的基準にして、何を言ったのか」と、レビューが付した限界の指摘まで読めます。

種別
外的基準
評価指標
キーワード

05 — CUT-OFF VALUES

カットオフ値を横断で見る

原著で報告されたカットオフ値・AUC・感度・特異度を、検査ごとにまとめました。同じ検査でも研究によって値が大きく違うことが、そのまま見て取れます。

読む前に:これらの値は感度と特異度のバランスから導かれたもので、「安全運転の最低水準」を示すものではありません。レビューは、ROC 解析由来のカットオフ値をそのように解釈することは適切ではないと明記しています。

ROC 空間に置いてみる

感度・特異度がそろって報告されている指標をプロットしました。左上に近いほど識別性能が高いことを意味します。点にカーソルを合わせると詳細が出ます。

06 — FULL TEXT

レビュー本文を読む

結果・考察・結論の要点を、原文の論旨に沿って再構成しています。

評価研究の全体傾向

組み入れた評価研究は、評価方法も外的基準も多様で、きわめて異質性が高いものでした。とくに外的基準については、運転関連能力の代替指標、医療者による総合判断、実車評価、公安委員会の最終判断、実運転行動、交通事故と、幅広いアウトカムが用いられていました。

方法論の面では、多くが単施設デザイン・単変量解析にとどまり、交絡調整後の独立因子の検証は不十分でした。表 1 は、外的基準の妥当性を考慮して、実車評価・公安委員会の最終判断・実生活での運転再開・事故や違反を外的基準とした 24 件に限って整理されています。

代替指標を外的基準とした研究

J-SDSA の合否(佐賀里ら 2024、高田ら 2019、前田ら 2022)や DS の合否(武原ら 2022、Hiraoka ら 2021、Yoshida ら 2025)を外的基準とした研究が一定数認められました。

J-SDSA 合否に関連する因子としては、注意機能および遂行機能を反映する TMT-B との関連が一貫して報告されています。佐賀里らはそれに加えて手掌部発汗反応を報告。DS 合否については、武原らが国内最大規模の報告として注意・遂行・視空間認知・記憶を示し、Hiraoka らはレーヴン色彩マトリックス検査、Yoshida らは J-SDSA ドット抹消検査の所要時間とエラー数を挙げています。

位置づけと限界:スクリーニングや補助的評価としては一定の意義があります。しかし運転行動そのものを直接反映するものではなく、実際の行動を直接測定しない代理指標は妥当性に限界があります(Hrisos ら 2009)。

医療者による判断を外的基準とした研究

医療者が神経心理学的検査や DS の結果をもとに総合的に判断した運転再開可否を外的基準とした研究群です(堀ら 2019、中米ら 2022、Katsuki ら 2021)。この研究群では、医療者判断に実車評価が組み込まれていません

堀らは医師の運転可否判断とコース立方体組み合わせテスト・DS 所見との関連、中米らは下肢深部感覚障害との関連を報告。Katsuki らは慢性硬膜下血腫に限定し、神経心理学的検査のみに基づく医療者判断と MMSE・TMT-A の関連を報告しました。医師が運転適性を判断する際に重視している評価項目を示唆する所見です。

位置づけと限界:単一の代替指標より複数の評価結果を反映する点で臨床的に重要な総合評価です。しかし判断の主軸は神経心理学的検査成績にあり、神経心理学的評価のみで運転適性を予測することの限界は既に指摘されています(Bellagamba ら 2020)。さらに、臨床判断そのものを外的基準にすると、予測因子と外的基準が同じ評価情報から導かれ、評価構造の循環性が生じます(Luchetti 2024)。

実車評価を外的基準とした研究

開放コース評価(加藤ら 2016b、高間ら 2023、Tabuchi ら 2023)と閉鎖コース評価(生田ら 2019、山田ら 2018、Kobayashi ら 2017)の双方が含まれます。

内容は、因子分析による運転技能の認知構造の解明(加藤ら 2016b)、特定の運転行動と運転可否の関連(生田ら 2019)、多変量解析・機械学習による予測因子の同定(Tabuchi ら 2023、Kobayashi ら 2017)、J-SDSA の予測式と国内カットオフ値の検討(高間ら 2023、山田ら 2018)に分かれます。

機械学習を用いた研究(Tabuchi ら 2023)は革新的ですが、症例数が限られ外部検証も未実施であるため、現時点では探索的知見と捉えるべきです。生田らの研究では、机上検査や DS で差がない症例でも実車評価で運転可否が分かれており、実車前評価のみで運転可否を決定することの限界が示唆されました。

Kobayashi らは SDMT 達成率を関連因子として報告しましたが、SDMT は著作権上の制約から国内での臨床使用が限られ、高次脳機能障害学会は WAIS の符号(Coding)を代替として推奨しています。ただし WAIS 符号と実車評価の関連は国内で十分に検討されておらず、研究知見と臨床実践の間にギャップが残ります。

J-SDSA については、原版予測式をそのまま適用すると妥当性が不十分であり(高間ら 2023)、国内データに基づく独自のカットオフ値が提案されています(山田ら 2018)。単純な翻訳ではなく、文化的背景と交通環境を踏まえた国内データによる再検証が必要だという重要な示唆です。

位置づけと限界:注意の配分、危険予測、車両操作を含む運転技能を直接評価できるため、ゴールドスタンダードとされます(Bellagamba ら 2020)。一方、研究上の外的基準として用いる場合、交通環境・評価コース・車両・評価者の違いが結果に影響し、標準化と再現性に課題が残ります。開放コースは実際の交通環境での対応を要し、閉鎖コースは統制条件下で行われるため、注意配分や危険予測への要求も異なります。さらに、実車評価の結果が公安委員会の最終判断や実生活の運転再開、事故発生と一致するかを検証した研究はごく少数です。

実車評価と多職種判断を併用した研究

全例に実車評価を行い多職種判断と組み合わせた報告(水嶋ら 2018)と、多職種判断を主軸に境界例のみ実車評価を行う段階的意思決定を採用した研究(伊賀ら 2021、大熊ら 2020)が含まれます。

水嶋らは運転可能群で α 波優位、保留群で θ・δ 波混入が多いことを報告しましたが、脳波指標と運転技能の概念的関係には慎重な解釈が必要です。伊賀らは VFIT の go/no-go 正答率と各 Stage のカットオフ値を、大熊らは DS の誤反応・発進停止・全般・判定得点のカットオフ値を提示し、3 項目以上の超過で非再開率が 79%に達することを示しました。DS は実際の運転場面に近い要求を再現できるため、回復期以降に適用できるカットオフ値を示した意義は大きいと評価されています。

位置づけと限界:実車評価を単独の外的基準ではなく意思決定プロセスの一要素として位置づけた点が特徴です。とくに境界例のみ実車評価を行う段階的アプローチは、負担・安全性・人的資源を考慮した実践的枠組みとして臨床的価値があります。一方で最終判断の根拠が症例ごとに異なり、予測研究では測定戦略の一貫性が重要であることから(Luijken ら 2019)、全例に同一基準を適用した研究に比べると妥当性は相対的に限定的です。

公安委員会の最終判断との一致を外的基準とした研究

実車評価を含む多職種判断と最終判断の一致を検討した研究(岩井ら 2022、外川ら 2019、Sotokawa ら 2024、細見ら 2019、原山ら 2022・2024・2025)と、実車評価を行わず総合判断と最終判断の一致を検討した研究(Morimatsu ら 2024、久保田ら 2024)が含まれます。

右半球損傷を対象とした研究では、机上検査で左半側空間無視(USN)が検出されない例でも、DS のトラッキング課題誤差率が高く(外川ら 2019)、刺激反応率が低い(Sotokawa ら 2024)ことが運転不可群で観察されました。静的評価では捉えにくい微細な左 USN が、動的課題で顕在化する可能性を示唆します。ただし全例で左 USN の存在が確認されたわけではなく、左右差の比較でも側性化は示されず全般的な反応率低下として現れたため、関連因子と左 USN の因果関係は推測の域を出ません。

多変量解析では、フレイル(原山ら 2025)や転倒歴(Harayama ら 2024)が関連因子として同定されました。いずれも複数の機能領域を含む統合的指標であり、運転能力との概念的関係には慎重な解釈が必要です。

また、急性期に運転不可と判断されたが再評価後に可と判断された患者では、再評価時の TMT-B、MMSE、FAB、レイ複雑図形検査、DS 交差点速度が関連因子として報告されました(久保田ら 2024)。急性期評価のみで運転適性を判断することの限界と、再評価の重要性を示す所見です。

位置づけと限界:実車評価を経た研究は、運転技能と公安委員会判断の整合性の双方を確認することで外的基準の妥当性を高めています。一方、最終判断は臨時適性検査の結果を取り込む場合もあるものの、医療機関からの情報に大きく依存しうるため、独立した外的基準の不在に伴う循環性の問題を完全に排除できません(Luchetti 2024)。

実運転行動を外的基準とした研究

評価から数か月後の運転再開状況を面接や質問紙で追跡した研究(武原ら 2014・2016、小渕ら 2023a・2023b、Inoue ら 2018、Sato ら 2021)と、さらに事故発生を質問紙で調査した研究(武原ら 2014・2016、寺尾ら 2023)が含まれます。

武原らは事故発生を直接外的基準とし、事故率が健常者と同程度の脳損傷者群の平均検査得点に基づく基準値を提案しました。ただし、個々の検査得点と事故発生・運転可否の関連を直接検証したわけではないため、解釈には慎重さを要します。

寺尾らは、事故・違反の有無で神経心理学的検査成績に有意差を認めませんでした。無事故群で再開後の運転時間が有意に短かったことから、事故・違反というアウトカムは机上検査だけでは十分に予測できず、再開後の行動修正と自己管理が安全運転の維持に重要な役割を果たす可能性を指摘しています。

急性期の DS 関連因子とカットオフ値を検討した研究(小渕ら 2023a・2023b)は、回復期以降を対象とした DS 研究(大熊ら 2020)と概ね同様の解析枠組みを用い、誤反応・発進停止・判定得点という共通の関連因子を示しました。提案されたカットオフ値にも大きな乖離はなく、運転再開の基準が病期を越えて一定の整合性を示す可能性があります。

FIM と運転再開の関連を検討した研究(Inoue ら 2018)もありますが、日常生活動作尺度である FIM と運転能力の構成概念の一致には慎重な解釈が必要です。また ICF(WHO 2001)に基づく多施設共同研究では、公共交通の不十分さや代替運転者の不在といった社会環境因子が、心身機能とは独立して運転再開に関連していました(Sato ら 2021)。

位置づけと限界:実生活での運転再開や事故は、実際の運転行動とその帰結を反映する外的基準です。ただし再開の有無は安全性そのものを保証しません。事故アウトカムは安全性を直接反映しますが、交通環境・運転頻度・自己管理行動は症例ごとに異なるため(Ahmad ら 2021)、外的基準としての妥当性は必ずしも高くありません。発生頻度が低いため統計的検出力にも制約があり、自己申告では交通行政記録に比べ過少報告される可能性があります(Finestone ら 2011)。今後は車載カメラによる実運転行動の縦断的追跡や、交通行政機関の公式運転履歴データの活用といった、より客観的な測定方法の確立が必要です。

介入研究:わずか 5 件

介入研究は 5 件にとどまり、介入目的・内容・アウトカムも多様でした。大きく手続き遵守支援運転行動の改善支援に分けられます。

手続き遵守支援

高次脳機能障害の概要、運転再開に必要な法的手続き、自主返納制度などを掲載したガイドブックによる教育的介入の研究(吉原ら 2024)。運転技能そのものではなく、公安委員会手続きの理解と遵守を支援する点が特徴です。歴史的対照群と比べ、安全運転相談・臨時適性検査の受検率が有意に高い結果(46.2%→90.5%)でした。ただし交絡調整が行われず、質問紙調査に基づくため選択バイアスの可能性に留意が必要です。

この種の介入は医療と社会をつなぐ支援として意義があります。一方、当該手続きは自己申告制であり、本人の意思決定支援のみでは限界があるため、公安委員会との連携や制度的環境整備を含む包括的支援が求められます。

運転行動の改善支援

DS の市街地走行とリプレイ機能(外川 2018a、外川ら 2018b)、JAF「実写版 危険予知・事故回避トレーニング」(渡邊ら 2021)、RehaCom「配分性注意 2」課題(北上 2023)が用いられていました。

DS +リプレイは、単群前後比較(外川 2018a)で運転行動と自己評価の改善を示しましたが、対照群がなく自然回復や学習効果を否定できず、アウトカムも DS 指標に限られました。傾向スコアマッチングを用いた比較研究(外川ら 2018b)では実車運転能力の一部改善が示されましたが、運転再開可否の判断を覆すほどの効果は認められませんでした。市街地走行とリプレイは同時実施されており、各成分の独立効果は未検証です。

JAF の危険予知トレーニングでは、同一危険場面の反復視聴で得点が向上しました。危険場面の理解向上が示唆される一方、学習効果と能力の汎化の区別は困難で、実運転への効果は検証されていません。RehaCom + DS の研究では群内で大きな効果量の改善が得られたものの、運転再開率には群間差がなく、変化量の群間比較も行われていません。

位置づけと限界:国内の運転行動改善支援研究は単群前後比較や歴史的対照群が中心で、研究デザイン上は探索的段階にとどまります。一方、これらの介入手法は本邦の交通環境や交通ルールを前提としており、海外知見の単純な適用には慎重さを要します。

考察:基準の“土台”をどう固めるか

外的基準の妥当性に関する検討は、最終的に運転適性判断基準そのものの妥当性を支える基盤となります。海外の枠組みを見ると、カナダやオーストラリアでは運動・感覚・認知機能を含む包括的評価が推奨され(Yao ら 2026、Austroads / National Transport Commission 2022)、国際的な臨床推奨ではスクリーニング → オフロード評価 → 実車評価を段階的に組み合わせる枠組みが提案され、TMT-B・SDSA・レイ複雑図形検査などが例示されています(Devos ら 2021)。ただし標準化された検査バッテリーや具体的基準値は示されておらず、運転可否判断への直接適用には限界があります。

これに対し、日本高次脳機能障害学会が公表した運転適性評価のフローチャートは、具体的な検査と基準値を提示し、国内の運転再開支援に一定の標準化をもたらした点で臨床的意義が大きいものです(学会 神経心理学的検査法小委員会 2022)。

しかし、そのフローチャートの妥当性は十分に検証されていません。フローチャート内の神経心理学的検査の基準は、健常者の平均±2SD に基づく年齢別基準値であり、外的基準との関連から導かれたものではありません。パブリックコメントへの回答(学会 2020)でも、神経心理学的検査の目的は安全運転の最低水準を定めることではなく、認知機能が健常者に近いかを評価することであり、運転能力そのものを評価するものではないと明記されています。それでも臨床では、これらの健常者基準値が運転可否判断の参考指標として参照されることが少なくありません。

  • 運転適性判断が目的なら、各種検査と外的基準の関連に基づき、感度と特異度のバランスを考慮して基準を設定することが望ましい。
  • 健常者基準に基づく相対評価は安全性の担保に一定の意義があるが、安全に運転可能な症例を過度に除外する可能性がある。
  • ROC 解析由来のカットオフ値は感度・特異度のバランスに基づくもので、安全運転の最低水準を示したものと解釈するのは適切でない
  • 年齢別基準では、同一得点でも高齢者は基準内、若年者は基準外と判定されうる。加齢による機能低下を踏まえれば、むしろ高齢者ほど十分な認知的余力が求められる可能性があり、年齢区分に依存しない基準設定の検討が今後の課題。

もっとも、同フローチャートは総合的判断を前提としており、個々の検査結果のみで運転可否を決定するものではありません。しかしそれは、各検査の予測精度や妥当性の検証を軽視してよいことを意味しません。

現実的な方策として、理想的には十分な症例数の多施設共同研究で多変量解析と一般化可能性の検討を行うべきですが、実務・制度上の制約があります。そこでレビューは、既報の主要指標とカットオフ値(DS、SDSA、TMT、レイ複雑図形検査など)を他施設の患者集団に適用して外的妥当性を検証する研究の蓄積を、実践的な進め方として提案しています。

本レビューの限界

  • ナラティブレビューであるため、文献検索・選択の網羅性は完全には担保されておらず、組み入れ文献ごとの一定尺度による質評価も実施していない(ただし SANRA による自己評価を実施)。
  • 統計解析のない症例報告・ケースシリーズを除外したことに加え、書籍や総説に含まれる知見は十分に反映されていない可能性がある。
  • 文献の抽出・整理は筆頭著者単独で行い、二重抽出による一致確認を行っていないため、選択過程に主観が介在した可能性は否定できない。

結論

脳損傷者の運転再開支援に関する国内の評価・介入研究は徐々に蓄積してきたが、各外的基準の特徴と限界を踏まえて妥当性を検証した研究、および介入効果が実際の運転関連アウトカムにどの程度反映されるかを検討した研究は限られている。

今後は、既報の評価指標について他施設の患者集団における外的妥当性のエビデンスを積み重ねること、そして各外的基準の特徴と限界を適切に理解したうえで、実生活の運転関連アウトカムを用いた評価研究・介入研究を発展させることが重要です。

臨床実践においても、評価指標やカットオフ値を一律に解釈するのではなく、それが依拠している外的基準の特徴と限界を理解したうえで用いることが求められます。

07 — AGENDA

構造的課題と今後の方向性

表 4 に対応。国内研究に共通して見られた課題と、レビューが示した進むべき方向です。

領域課題今後求められる方向性
まとめると:「妥当性の高い外的基準を、可能な範囲で選ぶ」「その特徴と限界を踏まえて検証を積み重ねる」。この二点が、運転再開基準の安全性と妥当性を高めるための実践的方策として提示されています。