{"id":"W347468065","doi":"10.3138/cjpe.0023.005","title":"The Road to Evaluation Capacity Building: A Case Study from Israel","year":2009,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); Presentation (obstetrics); Curriculum; Outcome (game theory); Relation (database); Capacity building; Psychology; Political science; Mathematics education; Sociology; Medical education; Pedagogy; Economics; History; Computer science; Medicine; Law; Archaeology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0284985,0.0006050135,0.0005858285,0.001989725,0.01468958,0.006498377,0.003312706,0.004667499,0.003713256],"category_scores_gemma":[0.0265905,0.0007041097,0.0005833305,0.002060473,0.007000397,0.00372182,0.006358905,0.005789024,0.0005841082],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01581141,"about_ca_system_score_gemma":0.01211165,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01973563,"about_ca_topic_score_gemma":0.03756786,"domain_scores_codex":[0.9743379,0.01919096,0.0006722937,0.0006336879,0.002127902,0.003037271],"domain_scores_gemma":[0.9653997,0.02276347,0.001764279,0.001499605,0.004792566,0.003780362],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.0004318813,0.009546266,0.07960134,0.0007974769,0.00008940995,0.03106911,0.6901072,0.005832908,0.003557276,0.0560385,0.009987618,0.1129409],"study_design_scores_gemma":[0.0001802674,0.001049216,0.02232176,0.001069169,0.00006387132,0.00486921,0.8838966,0.007161648,0.005863213,0.006729799,0.06666825,0.0001270749],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9524333,0.0004243215,0.005005562,0.005850092,0.00004747924,0.0006144567,0.00005273568,0.00003538224,0.0355366],"genre_scores_gemma":[0.9917898,0.0002697262,0.004524433,0.0004406254,0.00001553682,0.0001812913,0.0000384495,0.00002454566,0.00271569],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0284985,"threshold_uncertainty_score":0.1507163,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5869895881998264,"score_gpt":0.5568682661750065,"score_spread":0.03012132202481987,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}