{"id":"W4319439102","doi":"10.31038/ijnm.2022332","title":"Peer-to-Peer Evaluation: Kritik Pilot at Two Post- secondary Canadian Institutions","year":2022,"lang":"en","type":"article","venue":"","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Winnipeg; Brandon University","funders":"","keywords":"Peer review; Peer-to-peer; Political science; Psychology; Medical education; Public relations; Computer science; Medicine; World Wide Web; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03988734,0.001058477,0.001042569,0.001606026,0.009723791,0.003481794,0.003312612,0.001549576,0.003346808],"category_scores_gemma":[0.04463235,0.0008314414,0.000718245,0.00154039,0.003110271,0.001608953,0.004857701,0.003153591,0.001612723],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01579766,"about_ca_system_score_gemma":0.06050039,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.3635264,"about_ca_topic_score_gemma":0.6226159,"domain_scores_codex":[0.9794168,0.00699798,0.001117915,0.001728748,0.005642335,0.005096162],"domain_scores_gemma":[0.9132805,0.01076588,0.002111239,0.004636152,0.05013366,0.01907247],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.01509226,0.05283039,0.07379308,0.002588906,0.0002641276,0.004911639,0.3045612,0.005078467,0.04542797,0.002902143,0.04408332,0.4484664],"study_design_scores_gemma":[0.006499435,0.05431089,0.4466371,0.001112294,0.0004311462,0.0008371278,0.20977,0.01124549,0.06040563,0.001471139,0.2060203,0.00125945],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9675693,0.0001704848,0.003613947,0.001177905,0.0001452349,0.01449997,0.0005601145,0.0006570371,0.01160608],"genre_scores_gemma":[0.9553152,0.0002785902,0.02139118,0.0006320751,0.00006207378,0.006167154,0.0007995231,0.0002414055,0.0151128],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9842023,"threshold_uncertainty_score":0.7228209,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08764148884602259,"score_gpt":0.4014337841839782,"score_spread":0.3137922953379557,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}