{"id":"W2382198149","doi":"10.1111/bioe.12260","title":"Do We Know Whether Researchers and Reviewers are Estimating Risk and Benefit Accurately?","year":2016,"lang":"en","type":"article","venue":"Bioethics","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Estimation; Actuarial science; Risk analysis (engineering); Measure (data warehouse); Work (physics); Quality (philosophy); Computer science; Psychology; Economics; Medicine; Epistemology; Data mining; Management","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6004918,0.001447337,0.006302032,0.01074646,0.005568697,0.02221306,0.01090165,0.03001101,0.005333455],"category_scores_gemma":[0.9398987,0.002473389,0.00415851,0.009987723,0.02996683,0.04539081,0.006020311,0.02553434,0.005090075],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01498718,"about_ca_system_score_gemma":0.03586173,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01158841,"about_ca_topic_score_gemma":0.01179585,"domain_scores_codex":[0.2939244,0.5000796,0.08149657,0.0207918,0.09803195,0.005675667],"domain_scores_gemma":[0.04336209,0.7299696,0.07208166,0.03205416,0.117729,0.004803464],"domain_codex":"methods","domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001520347,0.0001092778,0.01188593,0.02730165,0.003530649,0.0004389659,0.02029286,0.001450722,0.0005978331,0.1032359,0.5151625,0.3144733],"study_design_scores_gemma":[0.000936836,0.0003625254,0.009522231,0.06955037,0.002637186,0.001299201,0.01308741,0.00486981,0.002874638,0.4805014,0.4130901,0.001268385],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"empirical","genre_scores_codex":[0.001446862,0.03119842,0.01295493,0.928747,0.02099293,0.000214533,0.0003049269,0.0001215761,0.004018938],"genre_scores_gemma":[0.144012,0.06181836,0.06218981,0.6603256,0.06580924,0.001938943,0.0004404112,0.0006069195,0.002858698],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.3995082,"threshold_uncertainty_score":0.4926648,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7003927520154161,"score_gpt":0.5213886242829595,"score_spread":0.1790041277324566,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}