{"id":"W4394769784","doi":"10.1016/j.acra.2024.02.028","title":"Use of Response Permutation to Measure an Imaging Dataset’s Susceptibility to Overfitting by Selected Standard Analysis Pipelines","year":2024,"lang":"en","type":"article","venue":"Academic Radiology","topic":"Radiomics and Machine Learning in Medical Imaging","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University; University Health Network","funders":"National Cancer Institute; National Institutes of Health; Queen's University","keywords":"Overfitting; Artificial intelligence; Random forest; Computer science; Support vector machine; Pattern recognition (psychology); Linear discriminant analysis; Machine learning; Logistic regression; Sample size determination; Cross-validation; Bootstrapping (finance); Receiver operating characteristic; Statistics; Data mining; Mathematics; Artificial neural network; Econometrics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.003049782,0.0002047907,0.0006311237,0.001236975,0.00007194446,0.00003201102,0.0001965245,0.0001799737,0.0000693204],"category_scores_gemma":[0.009885011,0.0001790534,0.00009682563,0.002938243,0.0001210773,0.0002200222,0.0000664628,0.0009597215,0.00001073602],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001754878,"about_ca_system_score_gemma":0.0002181185,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003681185,"about_ca_topic_score_gemma":0.00001715542,"domain_scores_codex":[0.9972075,0.0006800828,0.0006565737,0.0007044286,0.0003508676,0.0004005226],"domain_scores_gemma":[0.9979086,0.0009409591,0.00009508053,0.0004324357,0.0002280724,0.0003948721],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002294997,0.00002647822,0.1362922,0.00007692617,0.0004227799,0.00006020196,0.001752492,0.002264696,0.7003811,0.0000407877,0.1322318,0.02415554],"study_design_scores_gemma":[0.002045063,0.001754278,0.2680613,0.0006419001,0.004014391,0.0007881951,0.0008965555,0.3768276,0.01577395,0.0001566943,0.3279887,0.00105139],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9485102,0.0007490004,0.03464673,0.01484866,0.0001971421,0.0003446726,0.0005580974,0.0001378195,0.000007703889],"genre_scores_gemma":[0.9892076,0.00009034861,0.005977039,0.00292827,0.0002223697,0.00001425085,0.00141781,0.00003675615,0.0001055975],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6846071,"threshold_uncertainty_score":0.9984552,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02666421758784776,"score_gpt":0.3603955308308786,"score_spread":0.3337313132430308,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}