{"id":"W4302424535","doi":"10.1097/ogx.0000000000001086","title":"Accuracy of Surgeon Self-Reflection on Hysterectomy Quality Metrics","year":2022,"lang":"en","type":"article","venue":"Obstetrical & Gynecological Survey","topic":"Cardiac, Anesthesia and Surgical Outcomes","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Public Health","funders":"","keywords":"Medicine; Perioperative; Reflection (computer programming); Hysterectomy; Quality (philosophy); Patient safety; General surgery; Medical emergency; Surgery; Health care","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003359361,0.0002885533,0.001545198,0.0004224971,0.0002406236,0.00002344006,0.0002371896,0.000231829,0.001911335],"category_scores_gemma":[0.04120087,0.0002137782,0.0008143806,0.003535797,0.00007950172,0.00005579694,0.0001992768,0.0007764124,0.00007521253],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005962123,"about_ca_system_score_gemma":0.0001358465,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003430531,"about_ca_topic_score_gemma":0.00001175348,"domain_scores_codex":[0.9931849,0.003411259,0.0009176574,0.0005950576,0.001369721,0.0005213533],"domain_scores_gemma":[0.9411249,0.05745576,0.0003427536,0.0004844756,0.0002472111,0.0003449074],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00112478,0.00278835,0.9694496,0.00006112884,0.0001952181,0.000229284,0.0000521701,0.00004444946,0.0001959267,0.002044968,0.0006835398,0.02313061],"study_design_scores_gemma":[0.001554853,0.001719593,0.8947991,0.000004141207,0.00007481487,0.00002949164,0.00005676103,0.00004691616,0.0001677571,0.00003158994,0.1012813,0.0002337354],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9788921,0.0006390943,0.00004704842,0.0004650099,0.000842144,0.0006918181,0.00005664898,0.0002274089,0.01813869],"genre_scores_gemma":[0.9971601,0.0001028567,0.0002346151,0.0009028254,0.00004977355,0.0000712591,0.0001241163,0.00002365887,0.001330842],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1005977,"threshold_uncertainty_score":0.999001,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1003291693529437,"score_gpt":0.3610699179001942,"score_spread":0.2607407485472504,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}