{"id":"W4416263102","doi":"10.55016/ojs/cpai.v8i4.81528","title":"Applying Text Analysis for Detecting Academic Misconduct on a Statistics Exam","year":2025,"lang":"","type":"article","venue":"Canadian Perspectives on Academic Integrity","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Mount Saint Vincent University","funders":"","keywords":"Levenshtein distance; Similarity (geometry); Misconduct; Plagiarism detection; Academic dishonesty; Component (thermodynamics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.02010008,0.0005780634,0.0006212703,0.03198941,0.002928771,0.004271555,0.001601313,0.001228612,0.004992279],"category_scores_gemma":[0.1532324,0.0002322996,0.000470791,0.01866196,0.001382518,0.003601406,0.002800843,0.001408914,0.002510878],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002509153,"about_ca_system_score_gemma":0.004719043,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01354318,"about_ca_topic_score_gemma":0.02053991,"domain_scores_codex":[0.9792712,0.006302326,0.003510135,0.001723376,0.008571534,0.0006214709],"domain_scores_gemma":[0.8104433,0.1021933,0.02713482,0.01082052,0.04682066,0.002587377],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0005417323,0.000491126,0.2038913,0.001694237,0.0002041428,0.001872369,0.0433086,0.002421369,0.02076817,0.02080302,0.02173007,0.6822739],"study_design_scores_gemma":[0.000126451,0.001505372,0.537195,0.001484353,0.0003127067,0.003497161,0.08759181,0.09334418,0.0590645,0.05139095,0.1637036,0.0007839965],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7195097,0.001361945,0.1909009,0.002695638,0.0008111891,0.003872616,0.01114402,0.004150718,0.06555326],"genre_scores_gemma":[0.7931234,0.0006010936,0.1909758,0.0003507158,0.0003326444,0.001215547,0.004771766,0.0002638256,0.008365156],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9987714,"threshold_uncertainty_score":0.1063006,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05064526208466842,"score_gpt":0.3563301917343592,"score_spread":0.3056849296496908,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}