{"id":"W4416799325","doi":"10.1109/snpd65828.2025.11254871","title":"Cogniroot Edge: A Quest for A Fair AI Grader","year":2025,"lang":"","type":"article","venue":"","topic":"Intelligent Tutoring Systems and Adaptive Learning","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Algoma University","funders":"","keywords":"Grading (engineering); Usability; Process (computing); Software; Multiple choice","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03816323,0.0008437957,0.0009690892,0.004746105,0.003173683,0.01285933,0.003314786,0.002624304,0.00929238],"category_scores_gemma":[0.1116336,0.0005684004,0.00051968,0.001432702,0.00346977,0.01223565,0.006624097,0.0037144,0.006347256],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002688501,"about_ca_system_score_gemma":0.003576426,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002640864,"about_ca_topic_score_gemma":0.004088928,"domain_scores_codex":[0.9689105,0.01305562,0.001807873,0.003919257,0.0113862,0.000920556],"domain_scores_gemma":[0.9252548,0.01746646,0.003739908,0.007684791,0.04044579,0.005408262],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0004720195,0.0005156589,0.01591298,0.0004463452,0.00004757012,0.0002890064,0.01446027,0.001167811,0.01034658,0.1204416,0.04676197,0.7891381],"study_design_scores_gemma":[0.0001455309,0.001575215,0.02116585,0.001309885,0.0001150848,0.001610454,0.01251154,0.02798004,0.03175227,0.1406581,0.7607446,0.000431442],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1132086,0.001809136,0.6983946,0.03130179,0.002528003,0.00108021,0.0003226114,0.008062794,0.1432923],"genre_scores_gemma":[0.3670961,0.0008070917,0.5539898,0.006404538,0.000492844,0.0007575207,0.000498653,0.00244934,0.06750413],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.03816323,"threshold_uncertainty_score":0.2018288,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0224339298937731,"score_gpt":0.3102295826054359,"score_spread":0.2877956527116629,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}