{"id":"W2161422843","doi":"10.1145/2157136.2157215","title":"Stepping up to integrative questions on CS1 exams","year":2012,"lang":"en","type":"article","venue":"","topic":"Teaching and Learning Programming","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Formative assessment; Computer science; Code (set theory); Mathematics education; Programming language; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01005742,0.001186231,0.0007551052,0.001895146,0.0005583109,0.001931984,0.00125221,0.001292443,0.003098862],"category_scores_gemma":[0.1576687,0.0003647907,0.0004605181,0.001025301,0.0006247421,0.001884071,0.002107645,0.001265796,0.001534746],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005765018,"about_ca_system_score_gemma":0.0006265793,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003453959,"about_ca_topic_score_gemma":0.0007174378,"domain_scores_codex":[0.9872326,0.006969573,0.0008979518,0.00174737,0.002628339,0.0005242681],"domain_scores_gemma":[0.7137206,0.2484676,0.01709031,0.00706738,0.01054862,0.003105627],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.002408276,0.005413434,0.219104,0.001272772,0.0002105892,0.0007037442,0.03296442,0.007022555,0.06831722,0.001497843,0.003448187,0.6576371],"study_design_scores_gemma":[0.000563889,0.02769413,0.7386881,0.0008518962,0.0004248391,0.001908753,0.02056324,0.04357919,0.1286226,0.006274481,0.03027012,0.0005587266],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9897194,0.00006677407,0.007599134,0.00008156385,0.0000345428,0.0003622162,0.00008931183,0.0002405305,0.001806591],"genre_scores_gemma":[0.967304,0.0001076301,0.02910069,0.000158679,0.0000499592,0.0005854655,0.0004370329,0.00009516135,0.002161372],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01005742,"threshold_uncertainty_score":0.05318934,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03266876838149385,"score_gpt":0.3106006042948273,"score_spread":0.2779318359133334,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}