{"id":"W2784022277","doi":"10.3968/9985","title":"A Study on the Content Validity of English Writing Tests of GDNMET in the Circumstance of Ten-Year New Curriculum Reform","year":2017,"lang":"en","type":"article","venue":"Studies in literature and language","topic":"Educational Systems and Policies","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Syllabus; Content validity; Test (biology); Curriculum; Content (measure theory); Psychology; Mathematics education; Pedagogy; Psychometrics; Mathematics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007799265,0.00007113216,0.0001963256,0.00003933105,0.00007596516,0.00004469412,0.000465141,0.00002052365,3.569452e-7],"category_scores_gemma":[0.0006746843,0.00003400635,0.00002767317,0.0001490125,0.00009478212,0.0001139317,0.0001246526,0.000118389,6.406827e-8],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00001338486,"about_ca_system_score_gemma":0.00001618625,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008310366,"about_ca_topic_score_gemma":0.0004862154,"domain_scores_codex":[0.9993014,0.0001045607,0.0002256154,0.0001113924,0.0001681583,0.00008886363],"domain_scores_gemma":[0.9989201,0.0002754442,0.0001990532,0.0004472384,0.0001481429,0.00000996263],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"observational","study_design_scores_codex":[0.000002461832,0.0001428251,0.2495763,0.00007001,0.00002219392,0.000005508773,0.6994301,3.093194e-7,0.00004930271,0.04996663,0.000494757,0.0002396597],"study_design_scores_gemma":[0.0003336737,0.0001466013,0.7778298,0.0007014184,0.000004702009,0.00000163217,0.2200946,0.000001685144,0.0001444223,0.0005213491,0.0001645203,0.00005553285],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9919381,0.004302698,0.000001771673,0.0004323293,0.0002167111,0.0002388591,0.00001029124,0.000002632445,0.002856617],"genre_scores_gemma":[0.999589,0.00005801161,0.00006292442,0.00006885202,0.0001509824,0.00001347281,4.187075e-7,0.000001663262,0.0000546314],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5282536,"threshold_uncertainty_score":0.1386739,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08096752180264236,"score_gpt":0.3505752476020746,"score_spread":0.2696077257994323,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}