Gate Newsメッセージ、4月15日—BMJ Openに最近掲載された研究では、5つの主要なAIチャットボットが約50%のケースで問題のある医療アドバイスを提供しており、回答のほぼ20%が「非常に問題がある」と分類されていたことが分かりました。研究者は米国、カナダ、英国から参加し、ChatGPT、Gemini、Meta AI、Grok、DeepSeekを5つのヘルステーマにまたがる10の質問を用いてテストしました。
チャットボットは、ワクチンやがんといった閉形式の質問やトピックではより良い結果を示しましたが、自由回答形式の質問や、幹細胞や栄養のような領域では苦戦しました。テストされたどのチャットボットも、完全で正確な参考文献リストを作成できませんでした。
研究の著者らは、公衆向けのチャットボットが誤情報を増幅し得ると警告しました。これらのツールは医療アドバイスを提供するためのライセンスを受けておらず、根拠のない確信をもって誤った回答を提示する可能性があるためです。