信頼できるAIは、答えよりも「近くにある証拠」を見せる
Hatched by tttt
Aug 14, 2026
1 min read
0 views
91%
複雑なAIが、単純な「近所の人を見て判断する」方法に負けることがある。では、信頼できる判断に本当に必要なのは、より高度な計算なのだろうか。
むしろ重要なのは、判断がどれほど複雑かではない。何を根拠に、どの程度の確信を持って判断したのかを、人間が追跡できることである。
この視点に立つと、確率と最近傍法は別々の話ではなくなる。確率は、知らないことを数として扱うための言語だ。最近傍法は、判断の根拠を具体的な事例との距離として示すための仕組みだ。両者を組み合わせると、AIや人間の意思決定を改善する一つの実践的な原理が見えてくる。
信頼できる判断とは、正しそうな答えを出すことではなく、その答えの近くに何があり、どれほど不確かで、どこから先は分からないのかを示すことである。
不確実性を「気分」から「測定対象」に変える
人は不確実性を感じ取ることはできる。しかし、その感覚はしばしば極端になる。自信があるときには、九割以上確実なつもりになり、少し不安なときには、何も分からないように感じる。実際には、七割と五割の違いは大きいのに、日常会話ではどちらも「たぶん」と呼ばれてしまう。
確率を学ぶ最も大切な意味は、計算問題を解けるようになることではない。不確実性を、少なくとも原理的には数値化できる対象として見ることにある。これは世界を完全に予測できるという意味ではない。分からなさを放置せず、比較し、更新し、他者に伝えられる状態にするという意味だ。
たとえば、ある病気の検査結果が陽性だったとする。「陽性なら病気である確率は九十パーセント」と言われれば、かなり確実に聞こえる。しかし、検査を受けた集団の中で、その病気がどれほど珍しいかによって、実際の意味は大きく変わる。対象となる病気が非常にまれなら、陽性者の中には健康な人が相当数含まれる可能性がある。
ここで自然度数やオッズが役立つ。たとえば一万人のうち、病気の人が十人しかいないとしよう。検査が病気の人の九人を見つけ、健康な人の一パーセントに誤って陽性を出すなら、陽性者は九人の病人と約百人の健康な人になる。陽性という一つの情報だけでは、直感ほど確実ではないことが見える。
この例の価値は、確率の公式を覚えさせることではない。確率を、現実に起こる人数へ翻訳することにある。七十五パーセントという数字は抽象的だが、「四人中三人」と言い換えると、人は予測の規模を把握しやすくなる。数字の表現を変えるだけで、判断の誤りは減る。
最近傍法が教える「根拠の近さ」
最近傍法は、目の前のデータに最も近い過去の事例を探し、その事例のラベルや値を参考にする。新しい住宅の価格を推定するなら、広さ、立地、築年数などが似た住宅を探す。健康か病気かを分類するなら、特徴が近い過去の患者を見る。
この方法は驚くほど素朴だ。巨大な理論体系を構築する代わりに、「あなたに最も似ている事例では何が起きたか」と尋ねる。それでも、単純な方法が高度な方法を上回ることがある。これは単純さが常に優れているという意味ではない。問題に含まれる構造を、必要以上に複雑化しないことが強さになる場合があるということだ。
ただし、「近い」とは何を意味するのだろうか。二人の住宅を比較するとき、面積の差だけを見るのか、駅からの距離も同じ重みで扱うのか。病気の分類なら、年齢、体温、血圧、既往歴のどれを重要視するのか。距離は自然に存在するものではなく、何を似ているとみなすかについての設計判断である。
直線距離が適切とは限らない。都市の格子状の道路を歩くなら、二地点の距離は斜めの直線ではなく、縦と横に移動する距離の合計で考えたほうが現実的だ。これはマンハッタン距離の発想である。同じデータでも、距離の測り方を変えれば「最も近い事例」は変わる。
つまり、最近傍法は単純に見えて、重要な問いを隠し持っている。
- 何を特徴として選ぶのか。
- 特徴ごとの違いをどのように重み付けするのか。
- どの距離なら、現実の類似性を表せるのか。
- 近い事例が本当に信頼できるのか。
この問いを無視すると、アルゴリズムは計算上は整然としていても、現実には奇妙な判断をする。身長をメートル、年収を円で入力すれば、単位の違いだけで年収が距離を支配するかもしれない。データの欠落や測定誤差があれば、最も近い一点が偶然の外れ値になることもある。
一点の証拠から、証拠の近隣へ
一番近い事例だけを使う判断には、分かりやすさという利点がある。しかし、ひとつの事例にすべてを預けるのは危険だ。その事例がノイズを含んでいたり、誤ってラベル付けされていたり、そもそも特殊なケースだったりするからである。
そこで、最近傍法は近隣を複数見る方法へ拡張される。最も近い五件のうち四件が健康で、一件だけが病気なら、単独の一件よりも全体の傾向を参考にできる。回帰なら、近隣住宅の価格を平均して新しい住宅の価格を推定できる。これがk近傍法の基本的な考え方だ。
ここには、意思決定全般に使える原理がある。一つの証拠を信じるのではなく、関連する証拠の近隣を調べるという原理だ。
採用面接で一人の面接官の印象だけを採用判断に使う場合を考えてみよう。その人が候補者を「自社の過去の優秀な社員に似ている」と感じても、比較対象が少なければ偏りが入りやすい。複数の面接官、過去の職務成果、課題の実演、入社後の類似ケースを組み合わせれば、判断は一つの印象から証拠の近隣へ移る。
しかし、近隣を増やせば必ず良くなるわけではない。近すぎる範囲では偶然のノイズに影響され、広げすぎると異なる集団を混ぜてしまう。病院の例なら、年齢も症状も違う患者まで多数含めれば、平均は安定しても、目の前の患者に関する情報は薄くなる。
ここで重要なのは、予測値だけではなく近隣の質そのものを調べることである。近隣のラベルがほぼ一致しているなら、判断は比較的安定している。健康と病気が半々なら、予測は境界上にある。近隣全体がまばらで、対象に本当に似た事例が存在しないなら、アルゴリズムは「分からない」と言うべきだ。
これを三つの指標で考えると分かりやすい。
- 近さ: 参考事例が対象とどれほど似ているか。
- 一致度: 近隣の事例が同じ結論を示しているか。
- 密度: その周辺に、十分な数の信頼できる事例があるか。
この三つを組み合わせると、確率は単なる出力数字ではなくなる。たとえば「病気である確率は八十パーセント」と表示するだけではなく、「似た事例が二十件あり、そのうち十六件が病気だった。最も近い事例との距離は小さく、近隣の一致度も高い」と説明できる。受け手は確率を盲目的に信じるのではなく、その確率がどのように生まれたかを検討できる。
説明可能性は、装飾ではなく検査装置である
予測が当たるなら、理由を説明できなくてもよい。そう考える人は少なくない。しかし、説明は信頼を高めるための広報資料ではない。モデルが誤っている場所を発見するための検査装置でもある。
コンテンツ推薦を例に取ろう。ある視聴者に特定の番組を推薦したとする。推薦の理由が「高度なアルゴリズムが判断したから」では、編集者は妥当性を確認できない。一方で、「この視聴者が過去に見た三つの番組と、ジャンル、視聴時間帯、視聴完了率が近い利用者が、その番組を高く評価した」と表示されれば、編集者は根拠を点検できる。
その説明を見て、「この類似ユーザーは実は子ども向け番組ばかり見ている」「視聴時間帯は端末の自動再生で生じたものだ」と気づくかもしれない。説明は、利用者を納得させるだけでなく、データの欠陥や距離設計の誤りを発見する。
ここで、説明の粒度が重要になる。アルゴリズムの内部構造をすべて公開しても、受け手にとって理解不能なら説明にはならない。反対に、単純化しすぎて「あなたにおすすめだから」というだけでも意味がない。良い説明は、判断に影響した近隣事例、使用した特徴、代替候補、確信度を示す。
さらに、説明には反証可能性が必要だ。「この三つの特徴が違っていれば、結果は変わったのか」「近隣の事例を二件追加すると結論は維持されるのか」と問える説明である。理由が検証できるなら、組織はアルゴリズムを信仰するのではなく、監査できる。
実践のための「近隣付き確率」モデル
ここまでの議論を、意思決定の手順としてまとめよう。どのような予測や判断でも、答えだけを出すのではなく、その答えを囲む四つの情報を一緒に扱う。
まず、推定値を出す。病気の確率、住宅価格、推薦の関連度など、求められている結論である。次に、基準となる自然度数を確認する。全体の中でその結果がどれほど一般的かを見なければ、確率は誤解される。
続いて、近隣の構成を見る。似た事例を何件参照したのか、それらの結果はどの程度一致しているのかを確かめる。最後に、距離の妥当性を問う。そもそも、採用した特徴と重みは、現実における類似性を反映しているのか。
この枠組みは、AIだけでなく日常の判断にも適用できる。新しい顧客の売上を予測するなら、全顧客の平均だけでなく、業種、規模、導入時期が近い顧客を見る。新しい施策を評価するなら、成功例を一件探すのではなく、条件が近い複数の事例を比較する。ニュースの主張を受け取るなら、印象的な一例ではなく、母数、反例、類似条件のデータを探す。
不確実性を数字にすることは、冷たく機械的になることではない。むしろ、数字の背後にある比較対象と限界を明示することで、判断を慎重で人間的なものにする。誰かの人生に関わる判断ほど、「何となくそう思う」から離れ、どの事例を見て、どの程度の確信があり、どこに空白があるのかを共有する必要がある。
Key Takeaways
- 答えではなく、答えの周辺情報を記録する。確率や予測値だけでなく、母数、参照した事例数、結果の一致度も確認する。
- 一番近い事例を過信しない。外れ値や誤ったデータの影響を避けるため、複数の近隣事例を見て判断の安定性を確かめる。
- 距離の定義を疑う。何を「似ている」とみなすかは中立的な事実ではなく、特徴選択と重み付けによって決まる設計判断である。
- 確率を自然度数に翻訳する。「八十パーセント」と言う代わりに、「似た二十件のうち十六件」と表現し、受け手が規模を想像できるようにする。
- 説明を監査に使う。説明可能性を納得のための表示に限定せず、データの偏り、ノイズ、距離設計の誤りを発見する道具として扱う。
最後に、賢い判断とは何か
私たちは長いあいだ、知性を複雑なモデルや高度な計算能力と結び付けてきた。だが、現実の意思決定で本当に危険なのは、単純な方法ではない。根拠も限界も見えない方法である。
近傍を調べることは、世界を過去の事例との関係で理解することだ。確率を使うことは、その関係から導いた結論に、どれほどの不確実性が残っているかを認めることだ。この二つを合わせれば、AIは「答えを出す機械」から、「比較可能な根拠を示しながら判断を支援する道具」へ変わる。
そして、人間にも同じことが求められる。自分の判断に最も近い成功例だけを探すのではなく、複数の近隣を見て、距離の測り方を問い、確信度を数で表す。賢さとは、いつでも正しいことではない。自分が何を知っていて、何を知らず、どの事例の近くで判断しているのかを、他者と共有できることなのだ。
Sources
Hatch New Ideas with Glasp AI 🐣
Glasp AI allows you to hatch new ideas based on your curated content. Let's curate and create with Glasp AI :)
Start Hatching 🐣