{"id":"W2123930017","doi":"10.1111/j.1365-2923.2009.03438.x","title":"The effect of differential rater function over time (DRIFT) on objective structured clinical examination ratings","year":2009,"lang":"en","type":"article","venue":"Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":46,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Summative assessment; Formative assessment; Confidence interval; Psychology; Differential (mechanical device); Objective structured clinical examination; Function (biology); Statistics; Medicine; Mathematics; Psychiatry; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1057729,0.0006215166,0.0009850481,0.002242604,0.0008773968,0.001500326,0.001318487,0.00128356,0.002009698],"category_scores_gemma":[0.3192165,0.0005550727,0.001583441,0.002288278,0.00166965,0.001682959,0.002857822,0.001150965,0.0005258081],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001309382,"about_ca_system_score_gemma":0.0007591983,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001858689,"about_ca_topic_score_gemma":0.002121354,"domain_scores_codex":[0.8754333,0.0757174,0.01278208,0.01052766,0.0235031,0.002036375],"domain_scores_gemma":[0.4108759,0.4345231,0.09789465,0.03682243,0.01656797,0.003315882],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001857244,0.0001203288,0.9650549,0.0002288238,0.0007327679,0.0001097052,0.00269771,0.0009572904,0.001686072,0.0001860571,0.0005739596,0.02579526],"study_design_scores_gemma":[0.00001763733,0.0006479694,0.9968703,0.00004792802,0.00008237432,0.0001952691,0.0002507544,0.00089382,0.0005430959,0.00009925519,0.000326615,0.0000249775],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9784352,0.002260685,0.01531244,0.0004558793,0.0001860567,0.0002249828,0.0005367712,0.0001168319,0.002471235],"genre_scores_gemma":[0.9955603,0.0001501781,0.003124002,0.0001699676,0.00008683827,0.0001439587,0.0003286933,0.00006226527,0.0003737907],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1057729,"threshold_uncertainty_score":0.559387,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.004772557387152924,"score_gpt":0.3426991420525827,"score_spread":0.3379265846654297,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}