{"id":"W4297457303","doi":"10.2217/cer-2021-0274","title":"Developing a cross-validation tool for evaluating economic evidence in rapid literature reviews","year":2022,"lang":"en","type":"article","venue":"Journal of Comparative Effectiveness Research","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Public Health Ontario","funders":"","keywords":"Credibility; Medicine; Economic evaluation; Quality (philosophy); Systematic review; Management science; Software deployment; Evidence-based medicine; Economic model; Data science; Risk analysis (engineering); MEDLINE; Computer science; Economics; Alternative medicine; Macroeconomics; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5977936,0.002660138,0.00349307,0.02945699,0.002392937,0.00800708,0.00335811,0.002913482,0.005742871],"category_scores_gemma":[0.8530231,0.002235072,0.009755667,0.01403162,0.002793658,0.009333431,0.008419659,0.004196083,0.001258629],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004950543,"about_ca_system_score_gemma":0.01638446,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001654325,"about_ca_topic_score_gemma":0.002562358,"domain_scores_codex":[0.3772623,0.4691824,0.08873627,0.009053146,0.05380839,0.001957542],"domain_scores_gemma":[0.05552401,0.8009775,0.03809155,0.02130147,0.08292282,0.001182639],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002291566,0.000808281,0.06180958,0.03147378,0.008016472,0.0005836694,0.01130368,0.02067743,0.002867658,0.04378617,0.0239168,0.792465],"study_design_scores_gemma":[0.006209097,0.007411853,0.1254436,0.08431935,0.01689285,0.003533179,0.008858285,0.3437555,0.03319192,0.2201177,0.1474529,0.002813783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03803467,0.004046336,0.9122848,0.00321992,0.0008836977,0.02562388,0.001901702,0.003033255,0.01097186],"genre_scores_gemma":[0.08896482,0.0005223941,0.8891676,0.0004408153,0.00008379779,0.01972489,0.0006308994,0.0001617156,0.0003030936],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.4022064,"threshold_uncertainty_score":0.4959922,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9502567644813614,"score_gpt":0.7321332976015382,"score_spread":0.2181234668798232,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}