{"id":"W2054415360","doi":"10.1016/j.stueduc.2009.12.005","title":"Evaluation for learning: A cross-case analysis of evaluator strategies","year":2009,"lang":"en","type":"article","venue":"Studies In Educational Evaluation","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":19,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Alberta; Queen's University","funders":"","keywords":"Process (computing); Citizen journalism; Participatory evaluation; Reflection (computer programming); Program evaluation; Knowledge management; Computer science; Process management; Psychology; Sociology; Political science; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07237728,0.0006741517,0.0007788126,0.008694193,0.001867255,0.00444684,0.001839485,0.001677882,0.004266267],"category_scores_gemma":[0.2287419,0.0003169738,0.001048429,0.003317113,0.001496888,0.006643938,0.003491953,0.0009560552,0.0004695542],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005066568,"about_ca_system_score_gemma":0.004261845,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002860046,"about_ca_topic_score_gemma":0.003915768,"domain_scores_codex":[0.9202376,0.06306323,0.004351311,0.001626267,0.008702668,0.002018993],"domain_scores_gemma":[0.5661487,0.3819128,0.009329598,0.008887236,0.0318068,0.001914934],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.004574259,0.003982893,0.3122345,0.003047408,0.001196262,0.001898617,0.1124779,0.004622136,0.004304803,0.02537657,0.002528973,0.5237557],"study_design_scores_gemma":[0.00109065,0.01333143,0.5261942,0.00706409,0.004737012,0.00645377,0.2626217,0.07088315,0.02890502,0.04186464,0.03619789,0.0006564897],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9527079,0.002427216,0.02962194,0.0004079887,0.00002575481,0.001524993,0.0001421793,0.00006327751,0.01307867],"genre_scores_gemma":[0.9855512,0.0004081047,0.01245828,0.00006874457,0.00000509118,0.000465273,0.0001156436,0.00003277055,0.0008948744],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.07237728,"threshold_uncertainty_score":0.3827722,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5328970254040822,"score_gpt":0.6892803130688502,"score_spread":0.1563832876647679,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}