{"id":"W4306318633","doi":"10.1016/j.cct.2022.106963","title":"Machine learning for detecting centre-level irregularities in randomized controlled trials: A pilot study","year":2022,"lang":"en","type":"article","venue":"Contemporary Clinical Trials","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":false,"ca_institutions":"Impact; University of Toronto; Hamilton Health Sciences; Public Health Ontario; McMaster University; Population Health Research Institute","funders":"Canadian Institutes of Health Research","keywords":"Machine learning; Artificial intelligence; Medicine; Support vector machine; Unsupervised learning; Clinical trial; Computer science","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","metaepi_broad","research_integrity","insufficient_payload"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7181996,0.0008054834,0.03465131,0.0005189091,0.0006009883,0.0002094031,0.0009533225,0.0002758574,0.001262277],"category_scores_gemma":[0.9814019,0.0005739857,0.00575394,0.0005569402,0.0004173449,0.0001520123,0.0006708414,0.002377913,0.000009451086],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001502758,"about_ca_system_score_gemma":0.0006389589,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001477957,"about_ca_topic_score_gemma":0.00004360402,"domain_scores_codex":[0.3974771,0.5490415,0.04766893,0.002375074,0.002141909,0.001295594],"domain_scores_gemma":[0.04131053,0.9462062,0.01076345,0.000960351,0.0003691519,0.0003903825],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"randomized_trial","study_design_gemma":"randomized_trial","study_design_scores_codex":[0.9447795,0.007652635,0.002836639,0.0001715056,0.004256925,0.00009016223,0.0004667029,0.00004538007,0.00004432965,0.01961428,0.001959621,0.01808233],"study_design_scores_gemma":[0.5701227,0.004194665,0.000038896,0.0001144012,0.001403344,0.000001876135,0.001458006,0.003873585,0.00001375199,0.4175218,0.0008108495,0.0004461225],"study_design_candidate":"randomized_trial","study_design_consensus":"randomized_trial","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1221612,0.0151564,0.5016852,0.01089444,0.03941102,0.2964841,0.004105708,0.00239592,0.007706031],"genre_scores_gemma":[0.8757641,0.0001184337,0.1104962,0.0004760229,0.001871631,0.008769692,0.00002782574,0.0001783705,0.002297726],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7536029,"threshold_uncertainty_score":0.9999236,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8906204871631688,"score_gpt":0.6318866838975108,"score_spread":0.258733803265658,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}