試験で賢く見えるAIより、制度を知るAIが強い理由

KAZU

Hatched by KAZU

Jul 13, 2026

1 min read

86%

0

まず、なぜこの組み合わせが意外に重要なのか

AIが医師国家試験で合格点に届く。ここだけ聞くと、医療の未来はもう安心だと思いたくなる。だが、実際にはもっと厄介な現実がある。知識があることと、制度の中で正しく振る舞えることは別物だからだ。

たとえば、救急外来で優秀な研修医がいても、長期休止の扱いを知らなければ、研修の再開や継続に重大な影響が出る。逆に、制度の細部を熟知していても、臨床知識がなければ患者を救えない。そこで見えてくるのは、医療における本当のボトルネックは「賢さ」そのものではなく、知識を制度と現場に接続する力だということだ。

AIの試験成績と、研修休止の運用ルール。一見すると別々の話に見えるが、実は同じ問いを照らしている。能力とは何か。何が足りれば十分で、何が足りないと実務では破綻するのか。

医療の現場では、点数の高さよりも、例外の扱い方のほうが人を救う。


すべてを知っているように見えるものほど、制度の細部でつまずく

大規模言語モデルは、医学知識だけなら相当なところまで到達した。適切にプロンプトを工夫すれば、日本の医師国家試験で最低合格点に届くことさえある。しかし、誤答の分析をすると、失敗の原因は単なる「知識不足」だけではない。日本特有の医療制度やガイドラインへの理解不足、そして計算ミスが大きい。

この事実は重要だ。なぜなら、AIの失敗は人間の失敗に似ているからだ。臨床現場でも、事故は派手な無知より、細かな制度理解のズレから起こることが多い。たとえば、薬理を知っていても保険適用の制約を知らなければ処方は現実に通らない。救急対応を理解していても、研修の中断と再開の手続きを誤れば、その人の学びの軌道そのものが壊れる。

ここで浮かび上がるのは、医療には二層の知識があるということだ。第一層は教科書的知識。第二層は、制度、運用、例外、そして地域ごとの手続きだ。多くの人は前者を「本当の知識」と考えがちだが、現場では後者こそがしばしば決定的になる。

たとえば自動車の運転でも、交通ルールを知っているだけでは足りない。ETCの故障時の対応、車線変更が難しい地点、雪道での運転、保険事故の報告手順など、実務は例外の集合体だ。医療も同じで、制度は知識の付録ではなく、知識が現実に着地するための地面なのである。


研修休止90日という数字が教える、能力管理の本質

臨床研修において、休止期間が90日を超えると未修了となる。ここには単なる事務ルール以上の意味がある。この基準は、学習を「連続した経験の蓄積」と見なしている証拠だ。つまり医師養成は、知識を一回入れれば終わりではなく、継続性そのものが能力の一部なのだ。

この視点は、AIの評価にも通じる。試験で高得点を取ることは、その瞬間の応答能力を示す。しかし、医療に本当に必要なのは、長期的に制度や文脈を維持しながら機能することだ。休止が長引いたときに、同じプログラムで再開するのか、病院を変えるのか、誰がどう支援するのか。こうした問いは、能力を点ではなく履歴を持つプロセスとして扱っている。

ここに、現代の専門職教育の核心がある。能力とは、単発の正答率ではなく、中断後にどれだけ滑らかに復帰できるかまで含むものだ。人は病気、家庭事情、燃え尽き、進路変更で止まる。だから本当に強い制度は、止まらない人だけを前提にしない。止まった人が戻る道筋を持っている制度である。

この意味で、90日ルールは単なる制裁ではない。むしろ、専門職を壊さないための再接続プロトコルだ。中断を「失敗」と断じるのではなく、正確な情報把握、納得のいく判断、必要なら行政への相談、再開支援まで含めて設計する。ここには、能力評価よりも深い倫理がある。人をふるい落とすためではなく、学び直せる構造を保つための規律だ。


AIが試験に通っても、現場で安心できない理由

AIが試験に強くなると、私たちはついこう考える。ならば医療判断も任せられるのではないか、と。しかし、試験はしばしば「静かな世界」を測る。患者の急変、制度の制約、病院ごとの運用差、手続きの期限、説明責任、人間関係の摩擦は含まれない。

ここで鍵になるのは、正答率と運用力の差だ。正答率は、問いに対して正しい答えを返す能力を測る。運用力は、答えを現場の制約の中で実現する能力を測る。医療では後者が不可欠だ。たとえば、ある治療がガイドライン上は妥当でも、その患者の事情、病院の体制、地域の紹介体制、研修医の到達度によって、実際の選択肢は変わる。

AIが日本語の問題を英語に翻訳すると成績が上がったという結果も示唆的だ。これは単なる言語変換の話ではない。問いの形式が性能を左右するということだ。英語化によって、モデルが扱いやすいパターンに近づいたのだろう。だが臨床現場は、最もモデル化しにくい形式で問いを突きつけてくる。曖昧で、断片的で、感情が混じり、制度的制約が入り込み、しかも時間がない。

つまり、試験で強いAIは「問題を解く」ことには長けていても、「問題がどこから来て、誰が責任を持ち、どの制度に接続されるか」を理解しているとは限らない。これは人間の専門職にも同じことが言える。専門家の成熟とは、正解を知っていることではなく、正解を実行可能な形に翻訳することだからだ。

医療の高度化は、答えを増やすことではなく、答えを現場に通す回路を増やすことだ。


本当に必要なのは「知識」ではなく、三つの接続力である

ここまでをまとめると、医療における能力は三つの接続力に分解できる。

1. 知識接続力

教科書知識を、症例の文脈に結びつける力。これは診断や治療方針の土台になる。AIはここで強くなりつつある。

2. 制度接続力

知識を、保険、規則、研修制度、地域連携、ガイドラインに接続する力。ここでAIはまだ脆い。人間も、経験が浅いほど抜けやすい。

3. 継続接続力

中断、変更、復帰、再配置を含めて、学習や実務を途切れさせない力。90日ルールは、まさにこの領域を可視化している。

この三つが揃って初めて、医療は「知っている」から「できる」に変わる。逆に言えば、どれか一つでも欠けると、立派な知識は現場で空転する。AIは知識接続力を急速に伸ばしているが、制度接続力と継続接続力ではまだ人間の設計が必要だ。

この枠組みは、医療に限らない。法律、教育、公共行政、金融、災害対応でも同じだ。高性能なモデルや優秀な人材が失敗するのは、知識が足りないからではなく、接続先を見誤るからである。能力の本質は、情報量ではなく、情報をどの現実に変換できるかにある。


Key Takeaways

  1. 試験の高得点は、現場適応力の十分条件ではない。 正解を知っていることと、制度の中でそれを実行できることは別。

  2. 医療には、教科書知識と制度知識の二層がある。 後者は軽視されがちだが、実務ではしばしば前者と同じくらい重要。

  3. 中断への対応は、能力評価の一部である。 どれだけ上手に戻れるかは、専門職の成熟度を示す。

  4. AIの弱点は、知識不足だけではなく文脈接続の弱さにある。 日本特有の制度や運用に弱いなら、実務利用には補助設計が必要。

  5. 本当に強い制度は、例外を想定している。 休止、再開、変更、相談支援まで含めた設計が、人を守る。


終わりに: 賢さの定義を更新するときが来た

私たちは長いあいだ、賢さを「正しい答えを速く出せること」と考えてきた。だが医療の現場が教えるのは、もっと厳しい定義だ。賢さとは、知識を制度に、制度を人に、そして中断を再出発に変えられることである。

AIが試験で人間に迫るほど、むしろ見えてくるのは、人間の専門性の本体だ。そこには暗記以上のものがある。配慮、手続き、継続、説明責任、再接続。これらはテストでは見えにくいが、現実では決定的だ。

だからこそ、これから問うべきは「AIは何点取れるか」ではない。どんな制度の中で、誰を、どのように、途切れず支えられるのかだ。点数の時代から、接続の時代へ。医療の未来を決めるのは、もっとも賢い答えではなく、もっとも壊れにくい関係設計なのかもしれない。

Sources

← Back to Library

Hatch New Ideas with Glasp AI 🐣

Glasp AI allows you to hatch new ideas based on your curated content. Let's curate and create with Glasp AI :)

Start Hatching 🐣