AIモデル・生成AIの選び方
Googleの科学AIが示したインフル予測を業務の検証に変える
公開日 ・更新日
予測AIの評価は、首位という見出しだけで導入を決めない。Googleは、科学AIモデルがインフルエンザ関連の入院予測でCDC評価の首位だったと発表しています。大事なのは、その結果を自社の予測で再現できる条件へ分解することです。
評価データをそろえる
最初に、予測の対象、締め切り、正解が確定する時点を決めます。過去データを学習時と評価時に混ぜない、入力の更新日を残す、欠損を勝手に補わない。これだけで、後から数字を都合よく解釈するのを防げます。
正解率以外も見る
次に、平均的な誤差だけでなく、外れたときの損失、見逃し、過剰なアラート、確認にかかった時間を記録します。医療分野の評価結果は、あなたの業務の正解率を保証するものではありません。予測を使う人が、どの条件で止めるかまで決めて初めて実務の評価になります。
小さな範囲で人が確認する
最後は、対象を限定し、予測を読み取り専用で共有します。担当者が根拠データと更新時刻を確認し、判断を変える場合は理由を残す。結果が安定してから、通知や自動処理へ進めばいい。評価結果を運用条件へ変えるところに、AI導入の仕事があります。
出典・参考資料
関連記事
著者: 松井 勇樹