{"id":"W1994303059","doi":"10.1080/00220970309602065","title":"Pairwise Multiple Comparisons: New Yardstick, New Results","year":2003,"lang":"en","type":"article","venue":"The Journal of Experimental Education","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"ca_institutions":"York University","funders":"","keywords":"Bonferroni correction; Multiple comparisons problem; False discovery rate; Statistics; Pairwise comparison; Word error rate; Type I and type II errors; Computer science; Mathematics; Artificial intelligence; Biology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1293702,0.003924439,0.006735869,0.01046488,0.002732739,0.007957555,0.007384592,0.004051005,0.01748455],"category_scores_gemma":[0.4064703,0.002519896,0.003535698,0.01185468,0.01602936,0.012603,0.006854222,0.01597054,0.003347944],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003933176,"about_ca_system_score_gemma":0.003497293,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006940568,"about_ca_topic_score_gemma":0.001219884,"domain_scores_codex":[0.8284791,0.1051755,0.01279635,0.01626945,0.03605762,0.001221902],"domain_scores_gemma":[0.5499107,0.3673604,0.01327507,0.05038606,0.01654848,0.002519291],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.003713028,0.0007860089,0.004761167,0.008160683,0.003936795,0.0008818422,0.00284043,0.008959052,0.003023545,0.2109325,0.08201534,0.6699896],"study_design_scores_gemma":[0.001704133,0.006596212,0.01548985,0.004732535,0.0023344,0.003064231,0.001799499,0.07561053,0.007858247,0.6576534,0.2221017,0.001055212],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008732401,0.009610223,0.9487361,0.00358117,0.01198797,0.001426819,0.001674703,0.004368272,0.009882337],"genre_scores_gemma":[0.0706313,0.003654373,0.908162,0.001782049,0.002654782,0.007275585,0.0007396175,0.001513469,0.003586797],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1293702,"threshold_uncertainty_score":0.6841834,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5586051573696436,"score_gpt":0.5803779345219491,"score_spread":0.02177277715230552,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}