{"id":"W2588899142","doi":"10.5539/jel.v6n2p254","title":"Developing Achievement Test: A Research for Assessment of 5th Grade Biology Subject","year":2017,"lang":"en","type":"article","venue":"Journal of Education and Learning","topic":"Education, Safety, and Science Studies","field":"Social Sciences","cited_by":38,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Optimal distinctiveness theory; Test (biology); Psychology; Achievement test; Reliability (semiconductor); Item analysis; Mathematics education; Statistics; Content validity; Test validity; Multiple choice; Mathematics; Psychometrics; Standardized test; Social psychology; Significant difference","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006442896,0.000543829,0.0006400269,0.002956189,0.0005879163,0.0008772965,0.0008726203,0.0005422976,0.002216875],"category_scores_gemma":[0.01399169,0.0002080703,0.0007157585,0.001954543,0.0003801923,0.001237431,0.0008923219,0.0006299981,0.00113158],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007144561,"about_ca_system_score_gemma":0.002582835,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001597658,"about_ca_topic_score_gemma":0.002317915,"domain_scores_codex":[0.9948108,0.001528611,0.0007691638,0.0004221984,0.002248128,0.0002210595],"domain_scores_gemma":[0.9927006,0.002552541,0.00145004,0.000423948,0.002449278,0.0004236251],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004918199,0.002662487,0.5508317,0.0008553397,0.0001330411,0.0003201622,0.001285009,0.001003631,0.01147838,0.003051971,0.004477106,0.4234094],"study_design_scores_gemma":[0.00009487756,0.004454285,0.9654444,0.0002607709,0.0001063882,0.0008058115,0.0009596487,0.002735189,0.007689309,0.00116092,0.01624311,0.00004541174],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8961288,0.001753641,0.06186438,0.0005541164,0.0002961397,0.005956084,0.00305227,0.0007726758,0.02962191],"genre_scores_gemma":[0.8226393,0.001420039,0.1584421,0.0002168573,0.000107367,0.006050122,0.005128963,0.0001205986,0.005874685],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006442896,"threshold_uncertainty_score":0.03407365,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3319737515310354,"score_gpt":0.5908885332606288,"score_spread":0.2589147817295934,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}