{"id":"W6958172954","doi":"10.6084/m9.figshare.21397905.v1","title":"Additional file 5 of Machine learning algorithms to identify cluster randomized trials from MEDLINE and EMBASE","year":2022,"lang":"en","type":"article","venue":"Figshare","topic":"Data Analysis with R","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University; Ottawa Hospital; McMaster University; London Health Sciences Centre; Lawson Health Research Institute","funders":"","keywords":"Cluster (spacecraft); MEDLINE; Randomized controlled trial; Feature (linguistics); Support vector machine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0006490576,0.0001207598,0.0006543886,0.0001704153,0.0001465653,0.0001080483,0.00063803,0.00002566791,0.9908001],"category_scores_gemma":[0.02655608,0.0001061742,0.0001888739,0.0003903928,0.000007364497,0.0002506008,0.001350488,0.0001865629,0.0005987377],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002275878,"about_ca_system_score_gemma":0.00006158581,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004522162,"about_ca_topic_score_gemma":0.0000124333,"domain_scores_codex":[0.9975383,0.000949383,0.0004983789,0.0003774969,0.0004938122,0.000142684],"domain_scores_gemma":[0.9866536,0.01240687,0.0003859674,0.0003531914,0.00009497499,0.0001054261],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0003323129,0.00001982712,2.181696e-7,0.000007073418,0.00006732966,0.00001246528,0.00008080656,0.0002433507,0.000008289961,0.000002373797,0.9939237,0.005302281],"study_design_scores_gemma":[0.01210162,0.000033816,0.00006991999,0.0002082779,0.00002835976,0.000006057453,0.00001687068,0.254741,0.00005391284,0.0001419939,0.7324428,0.0001553771],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.00001126039,0.0001006482,0.001136089,0.0002493125,0.00003440887,0.0002814185,0.9980127,0.00004845044,0.0001257106],"genre_scores_gemma":[0.0003031875,5.692402e-7,0.02393943,0.0005198198,0.00009289377,0.001438563,0.9728338,0.000009430464,0.0008623843],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.9902014,"threshold_uncertainty_score":0.9816437,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04948925089532083,"score_gpt":0.3087076106663478,"score_spread":0.259218359771027,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}