{"id":"W4224793496","doi":"10.3138/cjpe.71430","title":"Redesigning a University-Based Evaluator Education Program for Scholarship and Practice","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Scholarship; Premise; Curriculum; Process (computing); Medical education; Pedagogy; Engineering ethics; Sociology; Psychology; Computer science; Engineering; Political science; Medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.03880038,0.0001048506,0.0001720929,0.0009358762,0.0008921162,0.0004710325,0.0004032438,0.0000471198,0.000764176],"category_scores_gemma":[0.01103715,0.0001018812,0.000100174,0.0009899825,0.00007004551,0.001040723,0.00001872609,0.0002697309,0.000005741257],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009327774,"about_ca_system_score_gemma":0.02241131,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001347979,"about_ca_topic_score_gemma":0.0009968302,"domain_scores_codex":[0.9946605,0.002148695,0.0005596971,0.0002488395,0.002143151,0.0002391104],"domain_scores_gemma":[0.9927693,0.001078706,0.0009061515,0.0002217784,0.004604332,0.0004197534],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001444301,0.0001468946,0.003915504,0.000006488091,0.00002175848,0.000002412594,0.0006358425,0.002987256,0.00004333088,0.0007894672,0.003010803,0.9882958],"study_design_scores_gemma":[0.00199445,0.002479655,0.01224887,0.00003452705,0.0002856373,0.0001035482,0.01099544,0.09396074,0.00003148239,0.00564866,0.8720331,0.000183894],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8650036,0.004375793,0.01941361,0.06341282,0.005870186,0.0299313,0.0001005319,0.0001145368,0.01177759],"genre_scores_gemma":[0.9176187,0.000003963729,0.08085257,0.0006656414,0.0001284044,0.0004388801,0.00003535082,0.00001289527,0.0002435848],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9881119,"threshold_uncertainty_score":0.9972933,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4058180102937288,"score_gpt":0.5556122397401135,"score_spread":0.1497942294463847,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}