{"id":"W2770107865","doi":"10.1136/bmjopen-2017-018593","title":"UpToDate adherence to GRADE criteria for strong recommendations: an analytical survey","year":2017,"lang":"en","type":"article","venue":"BMJ Open","topic":"Healthcare cost, quality, practices","field":"Health Professions","cited_by":39,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University; Impact","funders":"","keywords":"Medicine; Family medicine; Epidemiology; Public health; MEDLINE; Medical education; Nursing; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gpt","categories":["metaresearch"],"domain":"evaluation","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"},{"model":"grok","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"},{"model":"opus","categories":["metaresearch"],"domain":"methods","study_design":"design_other","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"medium","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3004365,0.001524525,0.006718619,0.02444218,0.003385577,0.009408256,0.008563939,0.005744459,0.008265354],"category_scores_gemma":[0.7390326,0.003372281,0.009034825,0.0219169,0.003329444,0.008619369,0.007543434,0.006170655,0.005276644],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0100011,"about_ca_system_score_gemma":0.03880292,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01323029,"about_ca_topic_score_gemma":0.01392883,"domain_scores_codex":[0.5177273,0.1576278,0.2181776,0.01168761,0.09124716,0.003532531],"domain_scores_gemma":[0.301099,0.2735201,0.1504139,0.03337943,0.2349314,0.006656129],"domain_codex":null,"domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001802306,0.000273002,0.07151636,0.2589566,0.007897075,0.0003821686,0.006628333,0.00181103,0.0009159445,0.007009679,0.2557271,0.3870803],"study_design_scores_gemma":[0.002928603,0.001196721,0.06452757,0.3262922,0.01048048,0.001740969,0.003292266,0.003887997,0.001508766,0.01050756,0.5728306,0.0008062392],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"review","genre_gemma":"empirical","genre_scores_codex":[0.05211337,0.2450743,0.1779048,0.08541673,0.01025518,0.2168453,0.1185423,0.004530032,0.08931807],"genre_scores_gemma":[0.2271408,0.09956168,0.3937716,0.02512906,0.001460646,0.2130293,0.03241309,0.001756746,0.005736999],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.6995635,"threshold_uncertainty_score":0,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9530837414453088,"score_gpt":0.7578939457473015,"score_spread":0.1951897956980073,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}