{"id":"W4412558422","doi":"10.36834/cmej.78199","title":"Documenting medical students’ use of self-explanations: tool development and initial validity evidence","year":2025,"lang":"en","type":"article","venue":"Canadian Medical Education Journal","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Computer science; Data science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2255653,0.001046987,0.001364264,0.008705663,0.001241214,0.004025693,0.003314312,0.001892735,0.002134281],"category_scores_gemma":[0.3708597,0.0008579162,0.002333662,0.004614683,0.002318667,0.003997955,0.004646814,0.001544211,0.00061438],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003735972,"about_ca_system_score_gemma":0.01064109,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001157891,"about_ca_topic_score_gemma":0.002870376,"domain_scores_codex":[0.7912022,0.128151,0.03646122,0.004010628,0.03787181,0.002303215],"domain_scores_gemma":[0.3747665,0.4903084,0.02531295,0.02049635,0.08666201,0.002453809],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.002444086,0.003190325,0.4833797,0.008799954,0.0008613776,0.0002801064,0.02011845,0.002119701,0.002464935,0.002626736,0.003490316,0.4702243],"study_design_scores_gemma":[0.004054077,0.02065091,0.7943777,0.0229905,0.002461394,0.002304839,0.02795075,0.04279466,0.03360344,0.007806889,0.04030836,0.0006965059],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8967147,0.00263955,0.05172993,0.001943475,0.0002768122,0.03408047,0.001645425,0.0005889828,0.01038048],"genre_scores_gemma":[0.7524352,0.001283778,0.2126485,0.0002887172,0.0000807781,0.03096698,0.001581757,0.00007948685,0.0006347669],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2255653,"threshold_uncertainty_score":0.9550158,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05838954697632896,"score_gpt":0.419011844293759,"score_spread":0.3606222973174301,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}