{"id":"W4321609600","doi":"10.1119/5.0075793","title":"Getting More Out of Midterm Assessments","year":2023,"lang":"en","type":"article","venue":"The Physics Teacher","topic":"Educational Assessment and Pedagogy","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Class (philosophy); Meaning (existential); Reading (process); Mathematics education; Psychology; Medical education; Computer science; Medicine; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01849674,0.001483505,0.001748468,0.004037552,0.002141394,0.007664057,0.002656016,0.002514032,0.06234683],"category_scores_gemma":[0.1214212,0.0009433518,0.00179933,0.002400143,0.0007102303,0.00933594,0.007464433,0.005392099,0.0292417],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00233992,"about_ca_system_score_gemma":0.003247706,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001787457,"about_ca_topic_score_gemma":0.00410214,"domain_scores_codex":[0.967512,0.008311405,0.00617895,0.004242992,0.01147732,0.002277314],"domain_scores_gemma":[0.8310134,0.04349829,0.01529786,0.02387099,0.06378063,0.02253889],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0006309386,0.001895957,0.0517025,0.00148202,0.00006483271,0.0005411939,0.01004536,0.0004156026,0.01027544,0.001648435,0.09827578,0.823022],"study_design_scores_gemma":[0.0002925328,0.003134505,0.2552596,0.003914487,0.000281717,0.002420618,0.02,0.003593372,0.02129209,0.01348196,0.6756349,0.0006942256],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.6023318,0.00453366,0.1127977,0.0433093,0.0112629,0.003338559,0.007256696,0.03081241,0.184357],"genre_scores_gemma":[0.6413504,0.002664384,0.1846253,0.02251123,0.002472565,0.00306638,0.008404867,0.00793115,0.1269737],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.06234683,"threshold_uncertainty_score":0.208571,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1529959497494024,"score_gpt":0.4903169867382567,"score_spread":0.3373210369888543,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}