{"id":"W2461165364","doi":"10.1186/s12885-016-2408-9","title":"Use and misuse of common terminology criteria for adverse events in cancer clinical trials","year":2016,"lang":"en","type":"article","venue":"BMC Cancer","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":59,"is_retracted":false,"has_abstract":true,"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto","funders":"Fudan University","keywords":"Common Terminology Criteria for Adverse Events; Medicine; Clinical trial; Adverse effect; Terminology; MEDLINE; Randomized controlled trial; Neutropenia; Intensive care medicine; Family medicine; Toxicity; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"reporting","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.614746,0.003061802,0.008871124,0.02864418,0.003539695,0.01029712,0.008231153,0.006116671,0.004601683],"category_scores_gemma":[0.8010861,0.00192958,0.013782,0.03578018,0.01148726,0.007312965,0.009523776,0.008760211,0.001591609],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01646874,"about_ca_system_score_gemma":0.02625324,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003514996,"about_ca_topic_score_gemma":0.003672783,"domain_scores_codex":[0.08925638,0.5141754,0.3248447,0.01032068,0.05989426,0.001508625],"domain_scores_gemma":[0.04586563,0.643159,0.2013353,0.04576965,0.06184718,0.002023275],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.006585265,0.0003677465,0.1078474,0.3056982,0.02071122,0.001290647,0.01940547,0.007030392,0.001783996,0.07162376,0.1423263,0.3153298],"study_design_scores_gemma":[0.005112906,0.002757642,0.1029956,0.2973444,0.01185959,0.005757834,0.006775929,0.01361234,0.005265961,0.1294026,0.4174744,0.001640644],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03335752,0.3101469,0.3701006,0.04798321,0.01445906,0.1393048,0.05513108,0.003884962,0.02563184],"genre_scores_gemma":[0.2522139,0.0388651,0.3681565,0.0262718,0.003831265,0.2849942,0.02259752,0.001293513,0.001776119],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.385254,"threshold_uncertainty_score":0.4750867,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9482729871807495,"score_gpt":0.6979188045437343,"score_spread":0.2503541826370151,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}