AIモデル・生成AIの選び方

Googleの科学AIが示したインフル予測を業務の検証に変える

公開日 ・更新日

予測AIの評価は、首位という見出しだけで導入を決めない。Googleは、科学AIモデルがインフルエンザ関連の入院予測でCDC評価の首位だったと発表しています。大事なのは、その結果を自社の予測で再現できる条件へ分解することです。

評価データをそろえる

最初に、予測の対象、締め切り、正解が確定する時点を決めます。過去データを学習時と評価時に混ぜない、入力の更新日を残す、欠損を勝手に補わない。これだけで、後から数字を都合よく解釈するのを防げます。

正解率以外も見る

次に、平均的な誤差だけでなく、外れたときの損失、見逃し、過剰なアラート、確認にかかった時間を記録します。医療分野の評価結果は、あなたの業務の正解率を保証するものではありません。予測を使う人が、どの条件で止めるかまで決めて初めて実務の評価になります。

小さな範囲で人が確認する

最後は、対象を限定し、予測を読み取り専用で共有します。担当者が根拠データと更新時刻を確認し、判断を変える場合は理由を残す。結果が安定してから、通知や自動処理へ進めばいい。評価結果を運用条件へ変えるところに、AI導入の仕事があります。

出典・参考資料

著者: 松井 勇樹