{"id":"W4416263102","doi":"10.55016/ojs/cpai.v8i4.81528","title":"Applying Text Analysis for Detecting Academic Misconduct on a Statistics Exam","year":2025,"lang":"","type":"article","venue":"Canadian Perspectives on Academic Integrity","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Mount Saint Vincent University","funders":"","keywords":"Levenshtein distance; Similarity (geometry); Misconduct; Plagiarism detection; Academic dishonesty; Component (thermodynamics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","sts","research_integrity","insufficient_payload"],"consensus_categories":["metaepi_narrow","research_integrity"],"category_scores_codex":[0.008523388,0.001283297,0.00179521,0.004280518,0.004365229,0.0003043147,0.00273779,0.009485421,0.001294606],"category_scores_gemma":[0.0225332,0.001402658,0.001038311,0.005744793,0.001882711,0.0007117999,0.0001401463,0.04245961,0.0002741297],"about_ca_system_candidate":true,"about_ca_system_consensus":true,"about_ca_system_score_codex":0.01045201,"about_ca_system_score_gemma":0.00858132,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.2336751,"about_ca_topic_score_gemma":0.1602424,"domain_scores_codex":[0.9891566,0.001800022,0.001805249,0.002775842,0.001285892,0.003176372],"domain_scores_gemma":[0.9881106,0.007066459,0.000867618,0.0008968203,0.001237554,0.001820932],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"qualitative","study_design_scores_codex":[0.0004637553,0.00009422822,0.003512509,0.0001560557,0.0026033,0.00002340088,0.06134695,0.0003336085,0.0001877396,0.8498497,0.04539615,0.03603261],"study_design_scores_gemma":[0.001852527,0.0006259846,0.003542222,0.001864538,0.004163111,0.00000767601,0.4840302,0.01352172,0.001114978,0.07667576,0.4096322,0.002969071],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.2221496,0.02613048,0.1157478,0.1395803,0.01734249,0.02723596,0.02553077,0.001119386,0.4251632],"genre_scores_gemma":[0.9647939,0.00415289,0.001335933,0.01316552,0.001993281,0.0007722168,0.0001052377,0.00009251382,0.01358857],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7731739,"threshold_uncertainty_score":0.9999919,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05064526208466842,"score_gpt":0.3563301917343592,"score_spread":0.3056849296496908,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}