{"id":"W3087581095","doi":"10.1111/jep.13474","title":"Relevance, validity, and evidential reasoning in clinical practice","year":2020,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Healthcare cost, quality, practices","field":"Health Professions","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institute for Work & Health; McMaster University; University of Toronto","funders":"","keywords":"Relevance (law); Psychology; Evidential reasoning approach; Clinical Practice; Medicine; Computer science; Artificial intelligence; Nursing; Decision support system; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","research_integrity"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2584639,0.0002678447,0.001230061,0.0002586198,0.0003071522,0.00008927796,0.0004134842,0.0008488083,0.0004049549],"category_scores_gemma":[0.8721056,0.0002535099,0.000242224,0.0009287533,0.0002091189,0.006070767,0.0003592627,0.009964751,0.0002766989],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004623749,"about_ca_system_score_gemma":0.004274664,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003753211,"about_ca_topic_score_gemma":0.0003337087,"domain_scores_codex":[0.8740439,0.1067502,0.01388485,0.0009449572,0.003578173,0.0007978404],"domain_scores_gemma":[0.5803707,0.3897736,0.01927853,0.0008197378,0.008352985,0.001404528],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.01380538,0.002456449,0.8385686,0.0006087117,0.0002206889,0.0008161382,0.006917747,0.0002269458,0.00001625015,0.001939467,0.03073298,0.1036907],"study_design_scores_gemma":[0.0102239,0.002384889,0.5221304,0.001611764,0.0008454023,0.000205422,0.01477392,0.007062459,0.000001229022,0.002413853,0.4379568,0.0003899662],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6317834,0.002809394,0.001336654,0.3452712,0.006330035,0.001853491,0.000005505851,0.00003657861,0.01057372],"genre_scores_gemma":[0.8601986,0.01386833,0.04293056,0.07659699,0.006242686,0.00004193556,0.000004806882,0.00005988662,0.000056233],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6136417,"threshold_uncertainty_score":0.9999917,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8578728121404361,"score_gpt":0.727442226012328,"score_spread":0.1304305861281081,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}