AIモデルの医療分野における限界が明らかになり、新たなベンチマーク「BiomedArena」が誕生しました。
この取り組みは、医療に特化したAIの評価を行い、正確な医療情報提供の必要性を強調します。
社会への影響は大きく、AIの医療利用における信頼性向上が期待されます。
記事の概要
AIモデルが医療分野での有用性が問われている中、DataTecnicaと米国国立衛生研究所(NIH)が発表した報告書は、現行の生成AIが医療において「安全で正確な出力」を提供できていないことを指摘しています。
多くの人がAIの医療アドバイスを信頼している一方、実際のバイオメディカル研究での性能は不十分であるとのことです。
研究では、医療科学に特化したベンチマーク「CARDBiomedBench」を用いて複数のAIモデルを評価し、その結果、専門知識のニーズを満たしていないと結論づけました。
これを受け、DataTecnicaはAIモデルの比較プラットフォーム「BiomedArena」を開発中で、医療研究に特化した内容の評価を行う予定です。
しかし、AIの実用性向上には、医療データへのアクセスや特定モデルの評価も重要な課題となっています。
記事のポイント
- 医療分野のAIの現状: AIモデルが医療分野での「安全かつ正確な出力」を提供できていないことが報告されています。
- 医療アドバイスへの信頼性: 多くの人々がAIの医療アドバイスを医師よりも信頼する傾向があることが懸念されています。
- 新たなベンチマークの導入: DataTecnicaとLMArenaが共同で医療研究に特化した評価システム「BiomedArena」を開発し、AIモデルの比較を行う予定です。
詳しい記事の内容はこちらから(引用元)
学術文献ではAIの進歩が数多く報告されているにもかかわらず、医療分野においては、全ての生成AIプログラムが「安全かつ正確…
https://japan.zdnet.com/article/35236878/