{"id":"W1788049718","doi":"10.3138/cjpe.29.3.54","title":"The Development and Initial Validation of Competencies and Descriptors for Canadian Evaluation Practice","year":2015,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"Barrie Urology Group","funders":"","keywords":"Psychology; Medical education; Computer science; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09585789,0.0006448261,0.0006162475,0.006037473,0.008010888,0.005860675,0.002794896,0.0009252451,0.001913193],"category_scores_gemma":[0.1584028,0.0005146367,0.0007657913,0.005237415,0.004156847,0.003081888,0.006506118,0.002971959,0.0004312194],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.08040093,"about_ca_system_score_gemma":0.2269523,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.634183,"about_ca_topic_score_gemma":0.7605325,"domain_scores_codex":[0.9447747,0.02707473,0.005001999,0.001685768,0.01848946,0.002973324],"domain_scores_gemma":[0.8274106,0.03128472,0.005228403,0.00840042,0.121543,0.006132863],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.0003117712,0.0009550885,0.09016465,0.002360401,0.00006311596,0.0004313498,0.09642905,0.003613932,0.006215713,0.06746478,0.02868323,0.703307],"study_design_scores_gemma":[0.0002629257,0.001176092,0.3549643,0.009158081,0.0001834779,0.0006637329,0.1910714,0.01696313,0.02177682,0.01880345,0.3845297,0.0004469357],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6403252,0.003370197,0.1556118,0.02165411,0.001148871,0.02328437,0.003050498,0.0007760565,0.1507788],"genre_scores_gemma":[0.723343,0.001561787,0.2565323,0.0007130489,0.0000327281,0.007622099,0.002161606,0.000151168,0.00788219],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9195991,"threshold_uncertainty_score":0.7359426,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5926820838299982,"score_gpt":0.5503943550828988,"score_spread":0.04228772874709941,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}