{"id":"W2281959534","doi":"10.1186/1745-6215-16-s2-o81","title":"Do pragmatic trials trade-off internal validity for external validity?","year":2015,"lang":"en","type":"article","venue":"Trials","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; Western University","funders":"","keywords":"External validity; Internal validity; Medicine; Psychology; Social psychology; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","insufficient_payload"],"consensus_categories":["metaresearch","insufficient_payload"],"category_scores_codex":[0.3381612,0.000383775,0.004792253,0.0004283482,0.0001812803,0.0003837633,0.0006478023,0.0003136873,0.001095678],"category_scores_gemma":[0.1991935,0.0004070268,0.0008952913,0.0001687107,0.00007673413,0.0007080417,0.00007336456,0.0002359965,0.002020634],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007337198,"about_ca_system_score_gemma":0.0004368926,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002951961,"about_ca_topic_score_gemma":0.00003292633,"domain_scores_codex":[0.9760686,0.007195822,0.01488304,0.0008814552,0.0002734311,0.0006976973],"domain_scores_gemma":[0.962559,0.02538436,0.01036496,0.000921238,0.000139447,0.0006310309],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001141262,0.0006025655,0.01449423,0.0009926824,0.0006184459,0.000005117374,0.005354652,0.0003013903,0.00005714187,0.2136989,0.7582994,0.00443419],"study_design_scores_gemma":[0.01537543,0.0008030668,0.002749261,0.0003613905,0.0001746106,0.00002975151,0.0009882031,0.003828583,0.0002496881,0.4490219,0.5253589,0.00105923],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3780181,0.0149457,0.418012,0.117726,0.0281303,0.02179291,0.008039255,0.0005779265,0.01275779],"genre_scores_gemma":[0.9105742,0.0005758473,0.04533346,0.01564462,0.01923041,0.003083,0.0002854914,0.0002752705,0.004997731],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.532556,"threshold_uncertainty_score":0.9998382,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8512957118541893,"score_gpt":0.5567504910613913,"score_spread":0.294545220792798,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}