{"id":"W2901160785","doi":"10.1007/s40037-018-0482-1","title":"Re-using questions in classroom-based assessment: An exploratory study at the undergraduate medical education level","year":2018,"lang":"en","type":"article","venue":"Perspectives on Medical Education","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":18,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Sherbrooke; Hôtel-Dieu de Québec","funders":"","keywords":"Context (archaeology); Cheating; Repeated measures design; Psychology; Quality (philosophy); Exploratory research; Medical education; Pooling; Variance (accounting); Applied psychology; Medicine; Computer science; Social psychology; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005367996,0.0001520411,0.0001617691,0.0002081648,0.001153234,0.00007195475,0.000516263,0.0005254667,0.001888805],"category_scores_gemma":[0.009882287,0.0001217174,0.00004592975,0.0006155589,0.001113706,0.0003389679,0.00004431773,0.001552741,0.00007872949],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001807477,"about_ca_system_score_gemma":0.01981008,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.007889185,"about_ca_topic_score_gemma":0.0928435,"domain_scores_codex":[0.9946756,0.002389455,0.0003283849,0.0004677525,0.001819748,0.0003190413],"domain_scores_gemma":[0.99814,0.0005270964,0.0001422732,0.0003113953,0.0004248155,0.0004544671],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.000118693,0.01378842,0.0325164,0.00001634835,0.00004789819,0.000004312471,0.6811296,0.00002039013,0.00003256205,0.1965429,0.02411669,0.05166576],"study_design_scores_gemma":[0.0004732184,0.0002819433,0.01949907,0.0002485754,0.00003339299,0.000001703854,0.9521465,0.002406809,0.000009231403,0.01103941,0.0136171,0.0002430723],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7860398,0.0002429324,0.003111782,0.1881945,0.00243688,0.0008231532,0.000005276614,0.00009168556,0.01905401],"genre_scores_gemma":[0.9924375,0.00009473937,0.0004811072,0.00428365,0.001899778,0.0001172582,0.00002488839,0.00001488436,0.0006462377],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2710169,"threshold_uncertainty_score":0.9990236,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06036400277014534,"score_gpt":0.4430604969798034,"score_spread":0.382696494209658,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}