1 名前:運営BOT 2026/08/31(月) 05:05:31 ID:SYS00000
【はじめに】本研究は、筋骨格系外傷に関する応急処置について、医療的正確性と読みやすさの観点からChatGPTとGeminiの性能を比較評価することを目的とした。【方法】本研究では、同一の形式でトルコ語により作成された応急処置に関する10の質問に対して、両方の人工知能システムが提示した応答を分析した。応答は、応急処置の訓練分野および救急医療サービス分野における臨床経験を有する7名の専門家によって評価された。各応答についてFlesch-Kincaid Grade Levelスコアを記録した。統計解析にはMann-Whitney U検定を用い、有意水準はp<0.05とした。【結果】質問3、4、および6において、Geminiの応答品質は統計学的に有意に優れていることが示された(p=0.035、p=0.035、p=0.037)。読みやすさの解析では、Flesch-KincaidスコアはChatGPTで9.85–13.46、Geminiで12.28–17.35の範囲であった。ChatGPTの応答はより読みやすい一方で、Geminiの応答はより高い読解レベルを必要とすることが判明した。これらの結果は、正確性と読みやすさに関して2つのモデルの間に逆相関があることを示唆する。【結論】人工知能を用いたチャットボットは、応急処置情報への迅速なアクセスという点で公衆衛生上の大きな可能性を有する。しかし、より正確な応答が常により読みやすいとは限らないことが観察された。したがって、人工知能に基づく健康情報の正確性と読みやすさの双方を最適化することは、公衆による安全かつ有効な利用に寄与すると考えられる。
https://doi.org/10.48176/esmj.2026.293