Google Researchは、医療対話AI「AMIE」をリアルタイム動画診療に拡張した研究を発表した。GeminiとProject Astraを基盤に、音声だけでなく表情、歩き方、呼吸、身体診察の動きといった視覚・聴覚情報を扱う。テキスト診断支援から、臨床現場に近いマルチモーダル相談へ踏み込む研究だ。
AMIE Videoが目指すもの
従来のテキスト型医療AIでは、患者が症状を文章に変換する必要があり、非言語情報が失われる。Googleは、AMIE Videoがリアルタイムの動画相談で患者役に身体診察の動作を案内し、視覚・聴覚の手がかりを統合して診断推論すると説明している。
研究では100シナリオ、300件のライブ相談、30人の認定プライマリケア医を含む比較を行い、リアルタイム動画診療で専門家レベルの性能を示したとしている。
基盤 | Gemini、Project Astra |
|---|---|
評価 | 100シナリオ、300ライブ相談 |
参加 | 30人の認定プライマリケア医 |
ビジネスと公共医療への意味
遠隔医療では、文章入力が苦手な患者や、症状をうまく説明できないケースがある。AIが動画から観察情報を補助的に整理できれば、医師の時間をより重要な判断や患者対応に使いやすくなる可能性がある。
高齢化、医療アクセス格差、企業の健康支援を考えると、医療AIのマルチモーダル化は大きなテーマだ。ただし、診断の自動化ではなく、医師中心の監督と臨床研究を前提に進める必要がある。
注意点
動画・音声・身体情報は極めてセンシティブだ。実用化には同意、保存期間、削除、説明責任、バイアス、医療機器規制、誤診時の責任を明確にしなければならない。研究成果をそのまま商用診断へ拡大するのは危険だ。


.png&w=384&q=75)

