{"id":"W4389105448","doi":"10.1063/5.0181787","title":"Statistical analysis of open book examination during COVID-19 pandemic: Lifelong learning","year":2023,"lang":"en","type":"article","venue":"AIP conference proceedings","topic":"Educational Assessment and Pedagogy","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Western University","funders":"","keywords":"Pandemic; Coronavirus disease 2019 (COVID-19); Computer science; Lifelong learning; Statistical analysis; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Artificial intelligence; Psychology; Virology; Statistics; Medicine; Mathematics; Pedagogy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001621822,0.00008475083,0.0002195667,0.0003579316,0.0005454423,0.0002532181,0.0004152149,0.00007433287,0.001584604],"category_scores_gemma":[0.001280664,0.0000896452,0.00003909815,0.001413821,0.00017573,0.0005838948,0.0001362628,0.0001419748,0.00002965098],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001570663,"about_ca_system_score_gemma":0.0007343949,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002721752,"about_ca_topic_score_gemma":0.0009193312,"domain_scores_codex":[0.9987459,0.0000717994,0.0002402965,0.00026709,0.0004163981,0.0002585389],"domain_scores_gemma":[0.998813,0.0004319407,0.0001819494,0.000044495,0.0003471905,0.0001813783],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000008500753,0.00001941779,0.8938816,0.0000307757,0.00008374244,6.651877e-7,0.03312877,0.000008997992,0.0006491698,0.07054909,0.0006310603,0.001008216],"study_design_scores_gemma":[0.00017542,0.00003067373,0.9337386,0.00001595417,0.0001681056,3.608044e-7,0.04014731,0.002403887,0.00001581703,0.002811034,0.02033901,0.0001538531],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9698758,0.00001874684,0.001516626,0.002683165,0.00006695489,0.0002531336,0.00001105634,0.0001372385,0.02543726],"genre_scores_gemma":[0.9897622,0.0002485796,0.0001731041,0.0001615121,0.00008848821,0.00005085054,0.00007346549,0.00000650325,0.009435273],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.06773806,"threshold_uncertainty_score":0.9993281,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1569600216800286,"score_gpt":0.4568753511800431,"score_spread":0.2999153295000144,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}