{"id":"W2322546226","doi":"10.3171/2016.1.spine14808","title":"Spinal Adverse Events Severity System, version 2 (SAVES-V2): inter- and intraobserver reliability assessment","year":2016,"lang":"en","type":"article","venue":"Journal of Neurosurgery Spine","topic":"Spine and Intervertebral Disc Pathology","field":"Medicine","cited_by":95,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; University of Toronto","funders":"","keywords":"Medicine; Intraclass correlation; Adverse effect; Kappa; Grading (engineering); Surgery; Multicenter study; Nuclear medicine; Physical therapy; Internal medicine; Randomized controlled trial; Psychometrics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000820198,0.0002173314,0.0006694722,0.0002677875,0.0000519381,0.000007063961,0.0001226438,0.0001111137,0.0001661232],"category_scores_gemma":[0.0004500963,0.0001316679,0.000350459,0.0001718255,0.0001058503,0.0004201307,0.0001179404,0.0003354755,0.00001844924],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002193128,"about_ca_system_score_gemma":0.0001407322,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000008460063,"about_ca_topic_score_gemma":7.755114e-7,"domain_scores_codex":[0.997952,0.0001951769,0.0009168864,0.0002820715,0.0003793941,0.0002744051],"domain_scores_gemma":[0.9985458,0.00002486824,0.0005210667,0.0003125836,0.0002995125,0.0002962178],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001401225,0.0007608153,0.710823,0.0007953722,0.000173363,0.003062778,0.00003634543,0.000002256543,0.2544315,0.0000849895,0.008963087,0.01946527],"study_design_scores_gemma":[0.002255501,0.003128621,0.9843128,0.001505172,0.0001308006,0.003420376,0.00004223776,0.00008143611,0.002188376,0.00002484318,0.002766568,0.0001432536],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.993513,0.00008516303,0.001234635,0.003265209,0.001489153,0.0001587944,0.00001238929,0.00002534894,0.0002162846],"genre_scores_gemma":[0.997683,0.0001647294,0.0009362043,0.0006018754,0.000264616,0.000002211286,0.000002472236,0.00002072063,0.0003240963],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2734898,"threshold_uncertainty_score":0.5369259,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0194096673594501,"score_gpt":0.2983738603898011,"score_spread":0.278964193030351,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}