{"id":"W4403764230","doi":"10.24908/pceea.2023.17122","title":"\"Please may I have some more?\" – Assessing Student and Instructor Intersubjective Agreement on Part Marks in Engineering Mathematics","year":2024,"lang":"en","type":"article","venue":"Proceedings of the Canadian Engineering Education Association (CEEA)","topic":"Design Education and Practice","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa; University of Toronto","funders":"","keywords":"Mathematics education; Agreement; Psychology; Pedagogy; Mathematics; Philosophy; Linguistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005319313,0.0002085772,0.0001822257,0.0005758777,0.00006007659,0.000355488,0.000178827,0.0001238552,0.00003142751],"category_scores_gemma":[0.0005993289,0.0002145788,0.00005498557,0.0003999768,0.00001136312,0.0005527298,0.00002139519,0.0004085499,0.000009306714],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003044563,"about_ca_system_score_gemma":0.0002911643,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005762587,"about_ca_topic_score_gemma":0.0005287404,"domain_scores_codex":[0.9988481,0.00000708847,0.0003428065,0.0002050296,0.0003036943,0.0002932746],"domain_scores_gemma":[0.9993204,0.0001633271,0.0001058021,0.00009803039,0.0001301575,0.0001822346],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.0000353769,0.00149346,0.1871603,0.02164418,0.003313828,0.00001459961,0.184458,0.1480402,0.03682651,0.2035244,0.170739,0.04275022],"study_design_scores_gemma":[0.001181289,0.0001035459,0.485466,0.007331777,0.0004229101,0.00005414671,0.02628513,0.3365842,0.01416673,0.0008320566,0.1251827,0.002389611],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9843482,0.0005083206,0.00007838471,0.003505143,0.004867982,0.0006328791,0.00002553987,0.0002106427,0.005822888],"genre_scores_gemma":[0.9978179,0.0000453432,0.0008938007,0.0001330743,0.0002267813,0.00008819821,0.000005931846,0.00005445308,0.0007345562],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2983057,"threshold_uncertainty_score":0.8750268,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.008160474789788371,"score_gpt":0.2483210386967957,"score_spread":0.2401605639070073,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}