
Mais plusieurs études scientifiques récentes rappellent qu’un chatbot, aussi performant soit-il, ne peut pas remplacer l’évaluation d’un professionnel de santé. Une étude menée par des chercheurs de l’Icahn School of Medicine at Mount Sinai et publiée le 23 février 2026 dans la revue Nature Medicine s’est penchée sur la capacité de l’intelligence artificielle à évaluer les urgences médicales.
Les chercheurs ont soumis à l’outil 60 scénarios cliniques couvrant 21 spécialités médicales. Chaque situation a été testée dans différents contextes, pour un total de 960 réponses analysées à partir de données référencées sur PubMed.
Le résultat a surpris les scientifiques. Dans 52 % des situations considérées comme des urgences vitales par des médecins, l’outil n’a pas recommandé de se rendre immédiatement aux urgences. Autrement dit, près d’un cas grave sur deux aurait été sous-estimé.
Un double problème : sous-triage et sur-triage

L’étude met également en évidence un phénomène inverse. Dans les situations bénignes, l’intelligence artificielle peut au contraire exagérer la gravité.
