{"id":"W4411776676","doi":"10.54254/2753-7048/2025.cb24291","title":"Educational Evaluation in China and the U.S.: A Literature-Based Inquiry into Its Impact on High School Students","year":2025,"lang":"en","type":"article","venue":"Lecture Notes in Education Psychology and Public Media","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Summative assessment; Formative assessment; Neglect; Educational equity; Psychology; China; Sociology of Education; Pedagogy; Academic achievement; Context (archaeology); Sociology; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.007744832,0.0001733413,0.000239321,0.00127552,0.0001512663,0.0003707816,0.0004267284,0.0002029509,0.001511529],"category_scores_gemma":[0.01344216,0.0001018649,0.0000373501,0.001923951,0.0002076135,0.0003225981,0.00004015284,0.0004907227,0.00002871036],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001429553,"about_ca_system_score_gemma":0.001779323,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004508402,"about_ca_topic_score_gemma":0.0003521063,"domain_scores_codex":[0.996407,0.001433819,0.0005468012,0.0005125112,0.0008989944,0.0002008237],"domain_scores_gemma":[0.9953834,0.003486566,0.0001806392,0.0004334607,0.0004137234,0.0001021614],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003667201,0.0005959669,0.6639777,0.00001226502,0.00001918032,1.727482e-7,0.009745996,0.0005561145,0.00001453282,0.009769168,0.00314238,0.3117998],"study_design_scores_gemma":[0.00209053,0.00003861041,0.7745729,0.00006621533,0.00000761195,0.000002024228,0.0001553941,0.001724044,0.000007798349,0.2207915,0.0004688621,0.00007447288],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8769884,0.003202409,0.000792942,0.1150027,0.002686486,0.0006164372,0.000002655212,0.000006456889,0.0007014698],"genre_scores_gemma":[0.9858616,0.0002103104,0.000272988,0.01281614,0.0002306816,0.0004665938,0.00009461773,0.000004781509,0.0000422727],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3117253,"threshold_uncertainty_score":0.9994012,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06168328790739908,"score_gpt":0.5345476808189168,"score_spread":0.4728643929115177,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}