Grands modèles de langage dans la décision clinique
7 essais- 2026O'Sullivan LLM (cardiology)Décision médicaleChez 9 cardiologues évaluant des cas complexes de suspicion de cardiomyopathie génétique, l'appui d'un système d'IA fondé sur un LLM a amélioré la qualité du triage, du diagnostic et de la prise en charge évaluée en aveugle par des surspécialistes par rapport aux cardiologues travaillant sans assistance.
- 2026Tao LLM (care transitions)Usage destiné au patientChez 2 069 patients consultant des spécialistes, un chatbot LLM recueillant l'anamnèse et rédigeant l'adressage avant la consultation a réduit la durée de la consultation spécialisée par rapport à l'absence de chatbot avant la consultation spécialisée.
- 2026Agweyu LLM (primary care, Kenya)Consultation autonomeChez 9 691 patients de centres de soins primaires au Kenya, une aide à la décision par LLM intégrée au dossier médical n'a pas réduit l'échec thérapeutique dans les 14 jours par rapport au dossier médical électronique seul.
- 2025Goh GPT-4 (management reasoning)Décision médicaleChez 92 médecins répondant à des vignettes cliniques, GPT-4 en plus des ressources conventionnelles a amélioré les scores de raisonnement de prise en charge par rapport aux ressources conventionnelles seules.
- 2025AMIEConsultation autonomeDans 159 consultations écrites avec des patients acteurs validés, une IA diagnostique conversationnelle fondée sur un LLM (AMIE) a amélioré l'exactitude diagnostique et la qualité évaluée de la consultation par rapport aux médecins de soins primaires.
- 2025Bolton AI antimicrobial prescribingDécision médicaleChez 42 cliniciens prescripteurs d'antibiotiques face à des vignettes cliniques, une aide à la décision par IA avec explications pour le relais intraveineux-oral ne différait pas de l'information standard seule pour la plupart des les décisions de relais et les temps de traitement.
- 2024Goh LLM (diagnostic reasoning)Décision médicaleChez 50 médecins travaillant sur des vignettes cliniques, l'accès à un grand modèle de langage en plus des ressources conventionnelles n'a pas amélioré les scores de raisonnement diagnostique par rapport aux ressources conventionnelles seules.