{"id":"W4297488519","doi":"10.23736/s0021-9509.22.12226-3","title":"Assessing endovascular team performances in a hybrid room using the Black Box system: a prospective cohort study","year":2022,"lang":"en","type":"article","venue":"The Journal of Cardiovascular Surgery","topic":"Patient Safety and Medication Errors","field":"Health Professions","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Medicine; Prospective cohort study; Black box; Cohort; Medical physics; Surgery; Artificial intelligence; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","sts"],"consensus_categories":[],"category_scores_codex":[0.03716521,0.0001931173,0.0009496414,0.0003179659,0.00190254,0.0000097138,0.0004711343,0.00004208027,0.0000353456],"category_scores_gemma":[0.00053081,0.0001122876,0.0009629016,0.0007367615,0.0001058437,0.0004237772,0.0002299232,0.001676288,0.000007311947],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009105171,"about_ca_system_score_gemma":0.001121808,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002865029,"about_ca_topic_score_gemma":0.000009221316,"domain_scores_codex":[0.9874371,0.008599309,0.001270922,0.0001960869,0.002038458,0.0004581185],"domain_scores_gemma":[0.9964239,0.00126174,0.001139077,0.0007681922,0.0003150297,0.00009204434],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001936258,0.0002304299,0.8308936,0.0001421802,0.003429293,0.0001426651,0.013386,0.1503975,0.00001231707,0.00001022724,0.000498856,0.0006632941],"study_design_scores_gemma":[0.002148316,0.0001296209,0.6966985,0.0007131586,0.002748818,0.0008339293,0.2714316,0.006089842,0.00003000715,0.00002633712,0.01883912,0.0003107589],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9854165,0.005414896,0.004476243,0.0001817696,0.001944522,0.00188724,0.000003378861,0.00002369753,0.0006518039],"genre_scores_gemma":[0.9989212,0.0003002566,0.00002605159,0.000107793,0.0004453353,0.0001408573,0.00000228027,0.00003031031,0.00002598552],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2580456,"threshold_uncertainty_score":0.9993969,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06018469045702071,"score_gpt":0.3489167668193517,"score_spread":0.2887320763623311,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}