{"id":"W2996434871","doi":"10.1515/ijnes-2019-0061","title":"A, B, or C? A Quasi-experimental Multi-site Study Investigating Three Option Multiple Choice Questions","year":2019,"lang":"en","type":"article","venue":"International Journal of Nursing Education Scholarship","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Red River College; Northwestern Polytechnic; Dalhousie University","funders":"","keywords":"Replication (statistics); Multiple choice; Psychology; Item response theory; Actuarial science; Medicine; Psychometrics; Clinical psychology; Statistics; Significant difference; Economics; Mathematics; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001356716,0.0001293041,0.000171811,0.0003470027,0.0002967862,0.0005327369,0.0006078443,0.00007795721,0.0002638487],"category_scores_gemma":[0.001808812,0.0001208336,0.0001004044,0.000282397,0.0001039872,0.001647549,0.00003026103,0.0003870887,0.00008819555],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009366362,"about_ca_system_score_gemma":0.0009495652,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004294093,"about_ca_topic_score_gemma":0.0005205059,"domain_scores_codex":[0.9975834,0.0003353229,0.0005122671,0.0001953462,0.001182604,0.0001910112],"domain_scores_gemma":[0.9976248,0.0004264499,0.0005789415,0.0001302875,0.001069241,0.0001703375],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00007523423,0.005667633,0.9570246,0.000001826298,0.00007398652,0.000001962786,0.02735223,0.00002797649,0.003967019,0.0007023896,0.0002364674,0.004868624],"study_design_scores_gemma":[0.001762096,0.0004349445,0.9392119,0.0005042374,0.00004478906,0.00002197693,0.05502181,0.0001365472,0.0001492556,0.0004013623,0.002120041,0.0001910303],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9888765,0.0001738345,0.0003327694,0.00206203,0.007061875,0.0004089245,0.000003008619,0.00003093141,0.001050166],"genre_scores_gemma":[0.9932292,0.00001101642,0.004554426,0.0001911419,0.001186518,0.00001240672,0.000009025308,0.0000133379,0.0007929795],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02766958,"threshold_uncertainty_score":0.5137194,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1581770451826993,"score_gpt":0.5024275049395138,"score_spread":0.3442504597568145,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}