{"id":"W2811264974","doi":"10.1111/jep.12983","title":"Evaluating the quality of medical evidence in real‐world contexts","year":2018,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":22,"is_retracted":false,"has_abstract":true,"ca_institutions":"Vancouver Enterprise Forum; University of British Columbia","funders":"","keywords":"Evidence-based medicine; Quality (philosophy); Context (archaeology); Hierarchy; Quality of evidence; Real world evidence; Psychology; MEDLINE; Medicine; Epistemology; Political science; Law; History","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3687431,0.001686945,0.007683632,0.01533983,0.003101995,0.03310592,0.005552897,0.009546095,0.002317385],"category_scores_gemma":[0.7132877,0.001943554,0.00368858,0.01089468,0.02650981,0.02968862,0.01052563,0.01002514,0.0005173467],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01328613,"about_ca_system_score_gemma":0.01720752,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003558135,"about_ca_topic_score_gemma":0.003422117,"domain_scores_codex":[0.3312788,0.554603,0.04993769,0.007739589,0.05354427,0.002896615],"domain_scores_gemma":[0.1860244,0.7011165,0.05180268,0.0207607,0.03687622,0.003419531],"domain_codex":"methods","domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001426408,0.000424526,0.02555207,0.02998433,0.01246621,0.0005587628,0.005711699,0.02581633,0.0007999386,0.5954536,0.01505156,0.2867545],"study_design_scores_gemma":[0.0004224003,0.0004480062,0.006034531,0.02146654,0.00190546,0.0002890851,0.003152848,0.01168444,0.0009227804,0.9338598,0.01952449,0.0002896315],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"review","genre_gemma":"methods","genre_scores_codex":[0.06010779,0.3405774,0.2296648,0.3236004,0.007060059,0.001786474,0.001111196,0.000223679,0.03586823],"genre_scores_gemma":[0.7569359,0.05210188,0.1722033,0.01325091,0.003086566,0.001528141,0.0002393646,0.00008746509,0.0005666184],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.6312569,"threshold_uncertainty_score":0.7784522,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8833932346435529,"score_gpt":0.722439555625765,"score_spread":0.1609536790177879,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}