Ce que les scores de plateforme manquent : évaluation multidimensionnelle des agents d'enseignement IA dans l'éducation médicaleWhat Platform Scores Miss: Multidimensional Evaluation of AI Teaching Agents in Medical Education.
ProfessionnelsJeune adulteÉtudes supérieuresInstrument d’évaluationÉtude transversale
Non déterminableRobustesse méthodologiquePubMed — neurosciences cognitives developpementalesSourceDOIRéférence disponible
Cette étude explore la qualité pédagogique d'agents d'enseignement basés sur de grands modèles de langage (LLM) en éducation médicale, en comparant les scores générés par la plateforme (dont les critères ne sont pas divulgués) à une grille d'évaluation multidimensionnelle à 8 dimensions (précision des connaissances, guidage pédagogique, couverture des connai...