{"id":"W4417272168","doi":"10.2139/ssrn.5841383","title":"Do Instructors Improve at Detecting AI-Generated Papers Over Time? A Longitudinal Study of Postsecondary Writing Instructor Knowledge and Perceptions of AI","year":2025,"lang":"","type":"preprint","venue":"SSRN Electronic Journal","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto; Laurentian University; Algoma University","funders":"","keywords":"Ambivalence; Longitudinal study; Perception; Generative grammar; Public speaking","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.009202215,0.0002567804,0.0004212979,0.001918946,0.001185109,0.003776777,0.0009766002,0.001170706,0.003074309],"category_scores_gemma":[0.08169124,0.0004863307,0.0004130518,0.0008817851,0.0005713974,0.002547761,0.001357114,0.001966574,0.001319968],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006577975,"about_ca_system_score_gemma":0.001444819,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003873271,"about_ca_topic_score_gemma":0.005269641,"domain_scores_codex":[0.9965958,0.0009120439,0.0003737756,0.0004232676,0.001369233,0.0003258596],"domain_scores_gemma":[0.8674965,0.04109541,0.05015403,0.005857829,0.02185264,0.01354359],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001649679,0.002256325,0.9617513,0.00003768247,0.00006406075,0.0001025891,0.008192547,0.00007983149,0.00103571,0.00005769283,0.0007741741,0.02548308],"study_design_scores_gemma":[0.00001941473,0.0008304974,0.9898921,0.00003374181,0.00003725692,0.0001021213,0.0064037,0.0004873274,0.0007569947,0.0001434378,0.001265906,0.00002749339],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9983564,0.0001479325,0.0001509785,0.0003748814,0.00002435022,0.00001448753,0.00005925272,0.00001746908,0.0008542378],"genre_scores_gemma":[0.9970657,0.0001958485,0.0003021068,0.0001819922,0.00003376887,0.00001865938,0.0001199417,0.00001068765,0.002071222],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9988293,"threshold_uncertainty_score":0.04866654,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03339514965763245,"score_gpt":0.3768797966234101,"score_spread":0.3434846469657777,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}