{"id":"W2113782520","doi":"10.5539/res.v4n1p255","title":"The Effect of Two Scoring Methods on Multiple Choice Agricultural Science Test Scores","year":2012,"lang":"en","type":"article","venue":"Review of European Studies","topic":"Mathematics Education and Pedagogy","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Multiple choice; Test (biology); Stratified sampling; Mathematics education; Statistics; Sampling (signal processing); Mathematics; Psychology; Computer science; Significant difference","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01824481,0.0005643594,0.001047169,0.001211703,0.0004298038,0.001282341,0.0006064874,0.000564587,0.002164736],"category_scores_gemma":[0.08036451,0.0003208105,0.0009067917,0.001812523,0.0006714157,0.0009675523,0.001002674,0.0008789921,0.0003663798],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005528611,"about_ca_system_score_gemma":0.001076923,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000864876,"about_ca_topic_score_gemma":0.002066048,"domain_scores_codex":[0.9488438,0.03231274,0.002718247,0.002301464,0.01295918,0.0008645023],"domain_scores_gemma":[0.8286127,0.141591,0.01520343,0.003229907,0.008305803,0.003057157],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.02218263,0.006563587,0.5115936,0.001374882,0.001569715,0.0003085604,0.004146592,0.001502475,0.01165892,0.0006872734,0.0009584656,0.4374533],"study_design_scores_gemma":[0.0005229091,0.04012864,0.9372371,0.000384163,0.0008854244,0.0003223419,0.002778766,0.002814735,0.01027405,0.0007499601,0.003744907,0.0001570864],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.993644,0.001029866,0.002324699,0.0001641667,0.0001126605,0.0001601735,0.00005430401,0.00003063569,0.002479522],"genre_scores_gemma":[0.9919339,0.0005084945,0.005990707,0.00006375143,0.00005027873,0.0001966122,0.0000588597,0.00001682104,0.001180567],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01824481,"threshold_uncertainty_score":0.09648889,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2094413455373212,"score_gpt":0.5251351568621729,"score_spread":0.3156938113248517,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}