{"id":"W6902004404","doi":"10.6084/m9.figshare.15179123","title":"Additional file 3 of Creating efficiencies in the extraction of data from randomized trials: a prospective evaluation of a machine learning and text mining tool","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Alberta","funders":"","keywords":"Information extraction; Extraction (chemistry); Data extraction; Text mining; Training set","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0194822,0.001676227,0.00242872,0.006048259,0.0009964833,0.003271539,0.003037164,0.001755289,0.8517786],"category_scores_gemma":[0.2496003,0.001356201,0.003173496,0.007102395,0.0006313791,0.003268995,0.00243929,0.001550407,0.08387892],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002246829,"about_ca_system_score_gemma":0.0057312,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003240701,"about_ca_topic_score_gemma":0.006375905,"domain_scores_codex":[0.9909525,0.003261904,0.003105653,0.001089609,0.001214744,0.0003756363],"domain_scores_gemma":[0.5902313,0.36933,0.01428657,0.009814304,0.01453209,0.001805748],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.003682559,0.0002902104,0.004580537,0.04576279,0.0008534305,0.0001964954,0.0003095784,0.001645176,0.0003463292,0.003107487,0.8966599,0.04256561],"study_design_scores_gemma":[0.06541357,0.001719585,0.03090268,0.0252796,0.003991882,0.001224066,0.0007417412,0.01321786,0.004553735,0.04661136,0.8056808,0.0006631979],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"empirical","genre_scores_codex":[0.0005916407,0.00008321511,0.003902748,0.0004279623,0.0000866539,0.002235939,0.9889612,0.002220921,0.001489724],"genre_scores_gemma":[0.03167612,0.000745317,0.1216236,0.002681689,0.0006202673,0.095911,0.7115275,0.008590945,0.02662361],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9805178,"threshold_uncertainty_score":0.2114197,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8280363040731956,"score_gpt":0.5556833541234769,"score_spread":0.2723529499497187,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}