{"id":"W3125553310","doi":"10.14288/1.0395120","title":"Determining the primary endpoints for diagnostic test accuracy reviews of substance use disorders","year":2020,"lang":"en","type":"article","venue":"Open Collections","topic":"Pharmacy and Medical Practices","field":"Pharmacology, Toxicology and Pharmaceutics","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Test (biology); Medicine; Diagnostic test; Pediatrics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","sts","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0007637303,0.0001441721,0.0003004751,0.00001841444,0.001526391,0.0001499052,0.0005831166,0.00008680711,0.001425096],"category_scores_gemma":[0.02535659,0.0001090693,0.0001118125,0.0005512221,0.0001810485,0.0005786121,0.00009758547,0.0005251769,0.0000220141],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003254533,"about_ca_system_score_gemma":0.0001394365,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00007869805,"about_ca_topic_score_gemma":0.0003398772,"domain_scores_codex":[0.998545,0.0004243066,0.000437797,0.0002465642,0.00009365402,0.000252702],"domain_scores_gemma":[0.9656863,0.03354227,0.0003326795,0.000158928,0.00008292693,0.0001969529],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0004026841,0.0006950349,0.004890233,0.0001599773,0.0001222077,0.000002967482,0.001199207,0.00006140247,0.001573389,0.00004139445,0.9559262,0.03492533],"study_design_scores_gemma":[0.001825674,0.0001789196,0.0009601631,0.0000279289,0.0002671184,0.000002704545,0.00006861987,0.0007669087,0.002040473,0.0001993787,0.9935286,0.000133482],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.1320254,0.01198624,0.01566582,0.1556158,0.01278162,0.05794073,0.00450416,0.000578572,0.6089017],"genre_scores_gemma":[0.7754155,0.06685934,0.004301554,0.1023743,0.001182276,0.005638042,0.0001893242,0.0001246765,0.04391498],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.6433901,"threshold_uncertainty_score":0.9997735,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3226134803611788,"score_gpt":0.4860988248720073,"score_spread":0.1634853445108286,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}