{"id":"W2402580331","doi":"10.1503/cmaj.150653","title":"Routinely collected data and comparative effectiveness evidence: promises and limitations","year":2016,"lang":"en","type":"article","venue":"Canadian Medical Association Journal","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":190,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Data science; Comparative effectiveness research; Data set; Promotion (chess); Field (mathematics); Computer science; Medicine; Political science; Alternative medicine; Pathology","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01924073,0.000106965,0.0005293724,0.0002349121,0.0003994316,0.0001534659,0.0002410762,0.0001989687,0.0004415972],"category_scores_gemma":[0.05102287,0.0001001224,0.0000257038,0.0001663214,0.00007749832,0.00073838,0.00004158085,0.0002454653,0.0002210657],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001121358,"about_ca_system_score_gemma":0.001766787,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001899832,"about_ca_topic_score_gemma":0.02232239,"domain_scores_codex":[0.9970617,0.0006369825,0.001455937,0.0003183551,0.0002036506,0.0003233393],"domain_scores_gemma":[0.9904873,0.007076215,0.001023516,0.0001831516,0.0002119363,0.001017915],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0000233078,0.00003799004,0.7668749,0.0001069472,0.0003050976,0.00001425172,0.002660396,0.000002231374,0.000008257227,0.01174177,0.2114887,0.006736084],"study_design_scores_gemma":[0.001464247,0.00007126325,0.856391,0.000493436,0.00001335329,0.00006434833,0.0007791671,0.002044838,0.00000165062,0.002753759,0.1357035,0.0002194737],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7185839,0.00321408,0.002747568,0.2700724,0.0007413213,0.0006820002,0.0006218665,0.00002200265,0.00331491],"genre_scores_gemma":[0.9912123,0.001133577,0.0003840135,0.00629144,0.0005014554,0.00002529014,0.00001155945,0.000009724428,0.0004306255],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2726285,"threshold_uncertainty_score":0.9955177,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5158783013887951,"score_gpt":0.4377154414609704,"score_spread":0.07816285992782473,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}