{"id":"W2995932983","doi":"10.3138/cjpe.56989","title":"Comparison of Canadian and American Graduate Evaluation Education Programs","year":2019,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Victoria","funders":"","keywords":"Professionalization; Graduate education; Graduate students; Population; Political science; Medical education; Program evaluation; Higher education; Library science; Sociology; Public administration; Medicine; Demography; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008103414,0.0003533827,0.0003089006,0.008239012,0.002835416,0.002554217,0.001803062,0.0004192628,0.004562097],"category_scores_gemma":[0.03023443,0.0002592069,0.0004437425,0.01105143,0.0009148329,0.0007920258,0.002315522,0.0008601799,0.000459843],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.05895828,"about_ca_system_score_gemma":0.09559872,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.8785822,"about_ca_topic_score_gemma":0.9434642,"domain_scores_codex":[0.9894651,0.001082538,0.0003535292,0.0005395331,0.006791782,0.00176754],"domain_scores_gemma":[0.9458715,0.003430351,0.002525887,0.0007189118,0.03745662,0.009996739],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008679947,0.0007404218,0.595954,0.0007301866,0.0001525345,0.0001153279,0.01238562,0.001286022,0.0008942173,0.0104047,0.05173228,0.3247367],"study_design_scores_gemma":[0.00003977809,0.0001563726,0.9351622,0.0003097978,0.00005092763,0.00008239107,0.007490042,0.0007436376,0.0005744317,0.0002670917,0.0550837,0.00003965416],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8544526,0.002705099,0.003525211,0.004464329,0.0002319793,0.0008375124,0.007181401,0.000290432,0.1263115],"genre_scores_gemma":[0.9799721,0.001558111,0.002964166,0.0005751414,0.00004078279,0.0003375173,0.004467698,0.0000597775,0.01002472],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9918966,"threshold_uncertainty_score":0.4277743,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5628449880548297,"score_gpt":0.5884740088916572,"score_spread":0.0256290208368275,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}