{"id":"W3095278952","doi":"10.2196/21620","title":"Pupillary Responses for Cognitive Load Measurement to Classify Difficulty Levels in an Educational Video Game: Empirical Study","year":2020,"lang":"en","type":"article","venue":"JMIR Serious Games","topic":"Visual and Cognitive Learning Processes","field":"Psychology","cited_by":35,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Pupillary response; Wilcoxon signed-rank test; Pupillometry; Computer science; Pupil size; Cognitive load; Video game; Cognition; Artificial intelligence; Machine learning; Psychology; Statistics; Mathematics; Pupil; Multimedia; Mann–Whitney U test","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00390953,0.0005067195,0.0004448915,0.0008497669,0.0002575363,0.0006863592,0.0005909078,0.0007024532,0.00106116],"category_scores_gemma":[0.01989114,0.000238982,0.0004111677,0.0005794839,0.0005320071,0.0008049047,0.0005189442,0.000628315,0.0003801088],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004538502,"about_ca_system_score_gemma":0.0002841745,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002389272,"about_ca_topic_score_gemma":0.002167685,"domain_scores_codex":[0.9973705,0.0009633217,0.0001921116,0.0005552629,0.000746743,0.0001720306],"domain_scores_gemma":[0.9788316,0.01439955,0.002561043,0.00102264,0.002738934,0.0004462122],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001806149,0.00577775,0.7440932,0.001081101,0.0003377828,0.0004628843,0.004731535,0.007127503,0.05172867,0.000682314,0.0009812634,0.1811899],"study_design_scores_gemma":[0.00005408888,0.003407701,0.9522427,0.00005623356,0.0001320221,0.0003982244,0.001022684,0.03222604,0.009480229,0.0001951089,0.0007375225,0.00004745023],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9950675,0.00007810804,0.004227915,0.0000111009,0.000004093127,0.0001093064,0.0000515992,0.00001251552,0.0004378712],"genre_scores_gemma":[0.9956098,0.00006241535,0.00385874,0.00001350589,0.000007737442,0.00007647404,0.00009543679,0.000006497312,0.0002694146],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00390953,"threshold_uncertainty_score":0.02067584,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1991487285468198,"score_gpt":0.4680045419754571,"score_spread":0.2688558134286373,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}