{"id":"W2086483769","doi":"10.1080/15305058.2011.552748","title":"Teachers' Perceptions of Large-Scale Assessment Programs Within Low-Stakes Accountability Frameworks","year":2011,"lang":"en","type":"article","venue":"International Journal of Testing","topic":"Educational Assessment and Improvement","field":"Decision Sciences","cited_by":41,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre for Advancing Health Outcomes; University of Alberta; Queen's University","funders":"","keywords":"Accountability; Seriousness; Scale (ratio); Perception; Psychology; Standardized test; Educational assessment; Medical education; Pedagogy; Mathematics education; Political science; Geography; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02081436,0.0001943476,0.0003157317,0.001383398,0.003842449,0.005183813,0.001272318,0.0009747926,0.001587548],"category_scores_gemma":[0.05710805,0.0003817413,0.0002383519,0.001241452,0.00485959,0.002028201,0.003083557,0.001769517,0.0001447689],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01376163,"about_ca_system_score_gemma":0.02032387,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.1943175,"about_ca_topic_score_gemma":0.2922613,"domain_scores_codex":[0.9664225,0.0165961,0.00111376,0.0008693414,0.01209591,0.002902421],"domain_scores_gemma":[0.9186791,0.03657488,0.01259856,0.003374234,0.01567777,0.01309541],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.0003477769,0.0007258248,0.3018779,0.0004650147,0.00006956033,0.001230522,0.593231,0.001663686,0.006157496,0.008553403,0.002692101,0.08298569],"study_design_scores_gemma":[0.00008795376,0.0007580242,0.355478,0.0006942841,0.00005613773,0.0003705258,0.5927958,0.003078928,0.001764314,0.003235447,0.04153534,0.0001451933],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9849037,0.0001836597,0.001484515,0.00130637,0.00001478605,0.00007940503,0.0000156376,0.00003037849,0.01198151],"genre_scores_gemma":[0.9987609,0.00007286895,0.0004057414,0.0000788859,0.000003881808,0.00002342591,0.000007935982,0.000004702429,0.0006416196],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1943175,"threshold_uncertainty_score":0.3863729,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1565396694431699,"score_gpt":0.4547954859236611,"score_spread":0.2982558164804912,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}