{"id":"W4404298071","doi":"10.1093/jnci/djae281","title":"Supporting evidence in phase 2 cancer trial protocols: a content analysis","year":2024,"lang":"en","type":"article","venue":"JNCI Journal of the National Cancer Institute","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Protocol (science); Clinical trial; Medicine; Attrition; Sample size determination; Evidence-based practice; Typology; Evidence-based medicine; Medical physics; Alternative medicine; Internal medicine; Statistics; Pathology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"reporting","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch"],"domain":"reporting","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008397534,0.0001602281,0.0007171923,0.0003497174,0.00007414655,0.0001196378,0.0005545489,0.0001013912,0.0004838686],"category_scores_gemma":[0.09396917,0.000097392,0.0006093954,0.001435422,0.0001530043,0.0004337194,0.00008213754,0.000661974,0.000002594976],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008992908,"about_ca_system_score_gemma":0.001838273,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009684791,"about_ca_topic_score_gemma":0.0002971145,"domain_scores_codex":[0.9952866,0.0005220321,0.002196606,0.0002335038,0.001528263,0.0002330354],"domain_scores_gemma":[0.9871041,0.0106619,0.001151886,0.0001517386,0.0008276197,0.0001028064],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.1188125,0.005177601,0.01174744,0.003842269,0.01986642,0.0008715722,0.003493673,0.02355264,0.01034803,0.4631829,0.09347466,0.2456303],"study_design_scores_gemma":[0.03261268,0.0005369294,0.001156589,0.006769934,0.002605085,0.00003654394,0.00003928457,0.008197675,0.002644521,0.9271154,0.0178853,0.0004000086],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5324941,0.007305653,0.2839999,0.06306935,0.05714947,0.05178201,0.002143011,0.0002203851,0.001836179],"genre_scores_gemma":[0.7834539,0.0004513273,0.1909139,0.002063885,0.01271714,0.008848581,0.000001292386,0.00007237181,0.001477614],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4639325,"threshold_uncertainty_score":0.9136627,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9056552129969474,"score_gpt":0.726209888188033,"score_spread":0.1794453248089144,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}