{"id":"W2248870587","doi":"10.1016/j.amjsurg.2015.08.032","title":"Validation of a novel intraoperative assessment tool: The Surgical Procedure Feedback Rubric","year":2015,"lang":"en","type":"article","venue":"The American Journal of Surgery","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":16,"is_retracted":false,"has_abstract":false,"ca_institutions":"Western University; Kingston General Hospital; Queen's University","funders":"Association for Surgical Education","keywords":"Rubric; Discriminative model; Variance (accounting); Construct validity; Observational study; Exploratory factor analysis; Construct (python library); Formative assessment; Psychology; Computer science; Medical physics; Medical education; Medicine; Artificial intelligence; Machine learning; Mathematics education; Psychometrics; Clinical psychology; Structural equation modeling","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002320813,0.0001017539,0.000491811,0.00009066291,0.00005247815,0.00002135497,0.00009982889,0.00001979163,0.00005995891],"category_scores_gemma":[0.0004763465,0.00004676761,0.00020209,0.0005475463,0.0003128086,0.00009747791,0.00002169288,0.0003025939,0.000002813763],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005732634,"about_ca_system_score_gemma":0.0005262042,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001167323,"about_ca_topic_score_gemma":1.459534e-7,"domain_scores_codex":[0.9984253,0.0002039074,0.0005689022,0.00007914451,0.0005770897,0.0001456617],"domain_scores_gemma":[0.996973,0.001521171,0.0007277721,0.0001453272,0.0005081965,0.0001245078],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0111809,0.002805669,0.6176814,0.0001041865,0.002047764,0.0004881597,0.01088798,0.01489585,0.003139748,0.002463612,0.004283913,0.3300208],"study_design_scores_gemma":[0.01205382,0.002033346,0.9254701,0.0009174604,0.0007920568,0.005733435,0.02626202,0.006764349,0.004667261,0.0005356851,0.01421162,0.0005588809],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9936208,0.00008128726,0.000285104,0.004621013,0.000142384,0.000100864,0.000002083428,0.000007812089,0.001138657],"genre_scores_gemma":[0.9988903,0.00004159204,0.0003052623,0.0004616049,0.0002312438,0.000002331028,0.000003056236,0.00001113437,0.00005350327],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3294619,"threshold_uncertainty_score":0.1907128,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0897675888133443,"score_gpt":0.3505367441726542,"score_spread":0.2607691553593099,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}