{"id":"W4399706167","doi":"10.1016/j.jval.2024.03.2436","title":"PT22 Consistency Between Comparative Efficacy Estimates from Target Trial Emulations and Their Origin Target Trials: A Meta-Epidemiological Study","year":2024,"lang":"en","type":"article","venue":"Value in Health","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Cascades (Canada); University of Toronto; McMaster University","funders":"","keywords":"Consistency (knowledge bases); Epidemiology; Meta-analysis; Medicine; Computer science; Artificial intelligence; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch","metaepi_broad","metaepi_narrow"],"domain":"methods","study_design":"meta_analysis","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch","metaepi_broad"],"domain":"methods","study_design":"design_other","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"medium","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","metaepi_narrow","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2922475,0.003549857,0.01088595,0.005214856,0.001025403,0.009133868,0.006783549,0.006981043,0.01473597],"category_scores_gemma":[0.6052948,0.003734987,0.03831334,0.008908444,0.004818608,0.007808416,0.003970312,0.008774421,0.001911259],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00166196,"about_ca_system_score_gemma":0.001392296,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001423122,"about_ca_topic_score_gemma":0.0007975648,"domain_scores_codex":[0.5918419,0.3318236,0.03965371,0.02309361,0.01165155,0.001935581],"domain_scores_gemma":[0.2010871,0.6966075,0.03998591,0.05310281,0.008077019,0.001139559],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","study_design_scores_codex":[0.02653082,0.0001152289,0.04610662,0.02182196,0.8685399,0.0004230701,0.0004741879,0.002521793,0.0003416978,0.003156449,0.003350806,0.0266175],"study_design_scores_gemma":[0.02008975,0.002709709,0.04704345,0.00696731,0.887504,0.001417433,0.0002899558,0.008535485,0.001104233,0.01693206,0.007132096,0.0002744838],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","genre_codex":"review","genre_gemma":"empirical","genre_scores_codex":[0.1971122,0.4814396,0.2700561,0.008663202,0.006207007,0.005159837,0.01632947,0.001775672,0.01325684],"genre_scores_gemma":[0.9605279,0.009975905,0.01767147,0.002770263,0.00116008,0.002350407,0.003180986,0.0005506153,0.001812521],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9964501,"threshold_uncertainty_score":0.8727849,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8587779294536831,"score_gpt":0.5553820052404167,"score_spread":0.3033959242132664,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}