{"id":"W2803849110","doi":"10.1111/medu.13574","title":"Validity as a social imperative for assessment in health professions education: a concept analysis","year":2018,"lang":"en","type":"article","venue":"Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":42,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Université de Sherbrooke","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Context (archaeology); Quality (philosophy); Psychology; Health care; Interpretation (philosophy); Inclusion (mineral); Educational assessment; Qualitative research; Management science; Medical education; Medicine; Computer science; Sociology; Pedagogy; Social psychology; Social science; Political science; Epistemology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00181046,0.0001672448,0.0004434316,0.0006022667,0.0004209735,0.00002620827,0.0001568606,0.0002466071,0.002811355],"category_scores_gemma":[0.00522005,0.0001496576,0.0001252795,0.002452763,0.0003438311,0.0001206156,0.00003104837,0.0005231954,0.00003246556],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001092761,"about_ca_system_score_gemma":0.03318837,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004940914,"about_ca_topic_score_gemma":0.0001580168,"domain_scores_codex":[0.9973211,0.0002665676,0.000804849,0.0004342619,0.0008193756,0.0003538639],"domain_scores_gemma":[0.998005,0.0001248841,0.0002881848,0.0003057279,0.001087915,0.0001882723],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.0001042168,0.007604085,0.02450322,0.0003171768,0.0002055167,6.016402e-7,0.0236563,5.329089e-7,0.00003802956,0.03380639,0.588184,0.3215799],"study_design_scores_gemma":[0.004112632,0.002140898,0.5383013,0.001347007,0.0008027706,0.00005074287,0.05306119,0.008561935,0.0002422164,0.008353252,0.3823234,0.0007026661],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5027544,0.0001401635,0.02831777,0.4556149,0.004761975,0.003036505,0.00001243631,0.0001032497,0.005258511],"genre_scores_gemma":[0.9288695,0.00001624714,0.0140116,0.04889592,0.002964641,0.001489126,0.001205476,0.00002108204,0.002526334],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5137981,"threshold_uncertainty_score":0.9981002,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0455642544269503,"score_gpt":0.5195881286295391,"score_spread":0.4740238742025888,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}