{"id":"W3010261457","doi":"10.1001/jama.2020.1230","title":"Validation and Utility Testing of Clinical Prediction Models","year":2020,"lang":"en","type":"article","venue":"JAMA","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":94,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"","keywords":"Medicine; Otorhinolaryngology; Family medicine; Neurology; MEDLINE; Psychiatry; Law","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07564846,0.001880926,0.001493737,0.004068389,0.0007266977,0.003430998,0.002314003,0.001924215,0.006854949],"category_scores_gemma":[0.2597259,0.000680902,0.002132982,0.00271509,0.001641963,0.002509482,0.00228611,0.003368136,0.002400726],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001850794,"about_ca_system_score_gemma":0.003597622,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00777064,"about_ca_topic_score_gemma":0.003474446,"domain_scores_codex":[0.9577369,0.03483719,0.001501031,0.002983721,0.002256487,0.000684693],"domain_scores_gemma":[0.6920469,0.2825459,0.004739242,0.01019667,0.008731372,0.001739902],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.009435385,0.003492667,0.4372155,0.0006688254,0.002829479,0.000370212,0.0006233003,0.2764336,0.0004383456,0.01127016,0.03769597,0.2195265],"study_design_scores_gemma":[0.0008766296,0.001023612,0.02851836,0.0002523787,0.0003826956,0.0002154376,0.0002708464,0.9534466,0.0005248718,0.01226694,0.002167784,0.00005395636],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.8186973,0.00444213,0.1358607,0.006495188,0.0009833177,0.001732612,0.01071841,0.002122916,0.01894734],"genre_scores_gemma":[0.9765251,0.000383458,0.01722074,0.0002932377,0.0001207329,0.0003643032,0.00408807,0.00009477693,0.0009096026],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.07564846,"threshold_uncertainty_score":0.400072,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7255774010685754,"score_gpt":0.4801200022781392,"score_spread":0.2454573987904362,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}