{"id":"W2808302722","doi":"10.1097/mao.0000000000001867","title":"Automated Metrics in a Virtual-Reality Myringotomy Simulator: Development and Construct Validity","year":2018,"lang":"en","type":"article","venue":"Otology & Neurotology","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"Lawson Health Research Institute; Western University","funders":"","keywords":"Medicine; Otorhinolaryngology; Construct validity; Medical physics; Myringotomy; Magnification; Simulation; Physical therapy; Artificial intelligence; Surgery; Patient satisfaction; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003622525,0.0001900411,0.0005541951,0.0003620218,0.0001021416,0.000008924301,0.00007645629,0.0002702863,0.0002264684],"category_scores_gemma":[0.0007112948,0.0001749704,0.00004071887,0.0004813228,0.0006065843,0.00003979629,0.00009631052,0.0002906503,0.00006105954],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004423361,"about_ca_system_score_gemma":0.0001263924,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002598392,"about_ca_topic_score_gemma":0.00005769008,"domain_scores_codex":[0.9982392,0.0002771119,0.0004800596,0.0004677592,0.000131699,0.0004041643],"domain_scores_gemma":[0.9986759,0.0007039757,0.000109891,0.0002255728,0.00009665517,0.0001879986],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004836011,0.0001865816,0.9772915,0.00003494117,0.00005860623,0.0006917831,0.0004328327,0.00004058988,0.000254246,0.003207797,0.00007246651,0.01724511],"study_design_scores_gemma":[0.008525094,0.0007082611,0.8732191,0.00002888715,0.00004758243,0.001022419,0.00006762274,0.04925428,0.00239741,0.0001900432,0.06426343,0.0002758391],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9937213,0.00001731829,0.0002794189,0.0003839425,0.0002658632,0.0005778975,0.000001558063,0.0003199608,0.004432733],"genre_scores_gemma":[0.9978359,0.000003522914,0.0005378295,0.001469627,0.0000486633,0.00004089859,0.00001035452,0.00001691305,0.00003624785],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1040723,"threshold_uncertainty_score":0.7135085,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07961333919648454,"score_gpt":0.3544019187128419,"score_spread":0.2747885795163573,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}