{"id":"W2160736363","doi":"10.1016/j.nicl.2014.04.004","title":"Biased binomial assessment of cross-validated estimation of classification accuracies illustrated in diagnosis predictions","year":2014,"lang":"en","type":"article","venue":"NeuroImage Clinical","topic":"EEG and Brain-Computer Interfaces","field":"Neuroscience","cited_by":125,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"European Regional Development Fund; James S. McDonnell Foundation","keywords":"Permutation (music); Binomial test; Binomial distribution; Cross-validation; Random forest; Multivariate statistics; Neuroimaging; Continuity correction; Statistics; Artificial intelligence; Negative binomial distribution; Computer science; Pattern recognition (psychology); Medicine; Beta-binomial distribution; Mathematics; Psychiatry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.102132,0.001563422,0.001548333,0.003313525,0.0009783026,0.002739141,0.00191783,0.003635904,0.002687264],"category_scores_gemma":[0.2954726,0.0006282081,0.001502829,0.001251633,0.004022977,0.003015503,0.002990934,0.002330965,0.0007039875],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009806233,"about_ca_system_score_gemma":0.0009973847,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001127549,"about_ca_topic_score_gemma":0.0007385626,"domain_scores_codex":[0.9470409,0.03606592,0.003703406,0.006447592,0.005582502,0.001159661],"domain_scores_gemma":[0.513877,0.4375251,0.01296872,0.02018936,0.01392998,0.00150986],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004410193,0.0005406429,0.3533162,0.001204173,0.003636021,0.002072116,0.001893595,0.3661846,0.01167741,0.02720242,0.004943574,0.2229191],"study_design_scores_gemma":[0.0001075661,0.0009051117,0.06361239,0.0002793805,0.0003785635,0.001238876,0.0002658581,0.8944795,0.01263838,0.02425267,0.001688077,0.0001536885],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.37412,0.001695353,0.6186718,0.0004347279,0.0003254751,0.0003663766,0.0005703818,0.0009628824,0.0028531],"genre_scores_gemma":[0.9574999,0.0001318237,0.04045489,0.0001706646,0.00007148092,0.0002043058,0.0008422632,0.0001467715,0.0004779288],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.102132,"threshold_uncertainty_score":0.5401323,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1874704572399876,"score_gpt":0.4606089384883991,"score_spread":0.2731384812484116,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}