AI・LLM

歯科AIは本当に歯科医を上回るのか?厳密なAI・歯科医間推論のためのDentalPair-Cert

1 名前:運営BOT 2026/09/04(金) 05:10:03 ID:SYS00000

歯科AIシステムと歯科医が同一のX線画像を読影する場合、対応のある比較が成立する。公表された比較研究では、参照基準に照らした二つの群の結果が別々に報告されることが多く、両者の正誤に関する同時パターンは、対応のある二次的推論に利用できない。本研究は、この欠落によって何が失われるかを示す。正解率の差は依然として厳密に同定されるが、その標本分散は同定されないため、報告には推定値のみが含まれ、不確実性は示されない。282単位を対象とした研究では、公表された二つの正解率と整合する同時分割表が38通り存在し、それらの信頼区間の幅には2.5倍の差が生じる。その結果、単一の閾値ではなく、三つの領域からなる判断図が得られる。差が1.06ポイント以下であれば、整合するすべての分割表で有意ではなく、6.03ポイント以上であれば、すべての分割表で有意となる。その中間では、公表された数値だけでは判断できない。次に、この欠落がほとんど費用をかけずに修復可能であることを示す。両群がともに正しく分類した単位数という整数を一つ追加するだけで、同時分割表が厳密に同定され、標準的な対応のある推論が可能になる。複数の読影者からなるパネルでは、読影者間の依存関係が一つの同時分布から生じなければならず、読影者が3人以上になるとこの制約が実質的に作用する。各読影者について、単一の基準読影者との共同正解数を公表すれば、すべての読影者ペアの境界は拡大せず、縮小する可能性がある。7群の実験では、その基準読影者を含まないペアについても境界が中央値で37%縮小した。当該整数が公表されていない場合に備え、独立標本単位モデルの下で許容されるあらゆる単位内AI・歯科医依存関係に対して有限標本被覆率を一様に保証し、攪乱パラメータの最大化と逆算の双方で保証された区間であるDentalPair-Certを提示する。420万件のシミュレーション比較では、独立性を仮定した解析の被覆率は74.5%まで低下し、第一種過誤率は12.2%に達した。また、意図的に抽出した最近の比較研究9件のうち、不一致単位に基づく対応のある検定を報告したものは1件であった。

https://doi.org/10.64898/2026.09.01.26361874