{"id":"W4411776676","doi":"10.54254/2753-7048/2025.cb24291","title":"Educational Evaluation in China and the U.S.: A Literature-Based Inquiry into Its Impact on High School Students","year":2025,"lang":"en","type":"article","venue":"Lecture Notes in Education Psychology and Public Media","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Summative assessment; Formative assessment; Neglect; Educational equity; Psychology; China; Sociology of Education; Pedagogy; Academic achievement; Context (archaeology); Sociology; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02061795,0.0003170082,0.0007180804,0.009224916,0.004045512,0.006876688,0.000816482,0.0007916503,0.001049602],"category_scores_gemma":[0.03002851,0.000221194,0.000468225,0.01432309,0.004620178,0.003647562,0.00384861,0.001059999,0.00006917188],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01862949,"about_ca_system_score_gemma":0.03103696,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.1008895,"about_ca_topic_score_gemma":0.1391602,"domain_scores_codex":[0.9879155,0.006317191,0.0009089414,0.0005075141,0.003224048,0.001126812],"domain_scores_gemma":[0.9659913,0.01879445,0.005364648,0.0008949353,0.006667427,0.002287157],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002297177,0.0006069335,0.5784427,0.002782848,0.0002341745,0.000667223,0.08505268,0.0007167695,0.0005038885,0.02004652,0.003700788,0.3070158],"study_design_scores_gemma":[0.00002527637,0.0004063264,0.8749011,0.003339071,0.0001665269,0.0001481003,0.1042473,0.000881327,0.0005726807,0.001750833,0.0134889,0.000072529],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"review","genre_scores_codex":[0.9579586,0.02011081,0.0002674681,0.00544935,0.0000961684,0.00008174348,0.0001129685,0.00001220408,0.01591065],"genre_scores_gemma":[0.9959136,0.003399044,0.000113051,0.000329405,0.0000172736,0.00002493274,0.00002933886,0.00000181901,0.000171677],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.1008895,"threshold_uncertainty_score":0.2006046,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06168328790739908,"score_gpt":0.5345476808189168,"score_spread":0.4728643929115177,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}