説明可能性

Explainability

説明可能性(Explainability)とは

説明可能性(Explainability)とは、AIシステムがなぜ特定の出力や判断を行ったのかを、人間が理解できる形で説明できる性質を指します。ブラックボックスと呼ばれる複雑なAIモデルの内部動作を明らかにし、AIの信頼性と責任ある利用を支える重要な概念です。

表:説明可能性の要点まとめ
ひとことで言うとAIがなぜその判断をしたのかを、人に説明できる性質。
どこで必要か融資の否決理由、採用の不合格理由、医療の診断根拠、保険の査定。
注意点説明できる簡単なモデルと、精度の高い複雑なモデルは両立しにくい。

説明可能性と解釈可能性の違い

説明可能性と解釈可能性(Interpretability)は関連しますが、異なる概念です。解釈可能性は、モデルの構造自体が人間にとって理解しやすいことを指し、説明可能性は、複雑なモデルであっても事後的に説明を生成できることを指します。決定木のような単純なモデルは本質的に解釈可能ですが、深層学習のような複雑なモデルでは、LIMEやSHAPなどの手法を用いて説明可能性を付与する必要があります。

図:説明可能性を確保する方法
1説明しやすい手法決定木や線形モデル
▶
2複雑でも後から説明SHAPやLIMEを使う
▶
3根拠を数値化どの要素が効いたか
▶
4相手に伝わる形に専門用語を避ける
▶
5記録を残す後から確認できる

説明の種類

説明にはさまざまな形態があります。特徴量の重要度を示すもの、類似した事例を提示するもの、反事実的説明(入力をどう変えれば結果が変わるか)を行うもの、ルールベースの説明を生成するものなどがあります。説明の対象者(専門家向けか一般ユーザー向けか)によっても、求められる説明の形態は異なります。

説明可能性の重要性

説明可能性は法的要件としても重視されています。EUのGDPRでは、自動化された意思決定に対する説明を受ける権利が規定されています。医療・金融・司法などの分野では、AIの判断根拠を示すことが信頼獲得と法令遵守の両面から求められています。