{"id":"W4200191876","doi":"10.1109/embc46164.2021.9629697","title":"Machine Learning Model Validation for Early Stage Studies with Small Sample Sizes","year":2021,"lang":"en","type":"article","venue":"2021 43rd Annual International Conference of the IEEE Engineering in Medicine &amp; Biology Society (EMBC)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Overfitting; Feature selection; Feature (linguistics); Cross-validation; Selection (genetic algorithm); Sample size determination; Model selection; Sample (material)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006092218,0.0002549456,0.0004981746,0.00009262127,0.00006625771,0.00001360537,0.0004079729,0.0001497742,0.00007706663],"category_scores_gemma":[0.003433143,0.0001811637,0.0001283408,0.0002633482,0.0002424627,0.0001299606,0.0001429483,0.0004717644,6.707045e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001069153,"about_ca_system_score_gemma":0.00009661877,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001210675,"about_ca_topic_score_gemma":0.0002377346,"domain_scores_codex":[0.9986356,0.00007265009,0.0004868276,0.0003332743,0.0002102536,0.0002613944],"domain_scores_gemma":[0.9968788,0.001501888,0.0002751318,0.0002779984,0.001025458,0.00004069462],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004178064,0.0005717361,0.02712814,0.00162077,0.00331219,0.000007568884,0.04097403,0.2749691,0.2876745,0.3545931,0.005863484,0.002867683],"study_design_scores_gemma":[0.006904878,0.001555364,0.001216098,0.004654906,0.0004978658,0.00004258468,0.01159271,0.5166897,0.09391065,0.3412533,0.01956414,0.002117854],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2423569,0.0001951281,0.7549245,0.001445245,0.0003556571,0.0002992679,0.0001867424,0.00009367019,0.0001429613],"genre_scores_gemma":[0.6499213,0.001072098,0.3460448,0.000108187,0.0001992817,0.0001312491,0.0001759938,0.00004383753,0.002303206],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.4088796,"threshold_uncertainty_score":0.7387642,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2296422583971432,"score_gpt":0.4107561751219546,"score_spread":0.1811139167248114,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}