{"id":"W1482775425","doi":"10.55016/ojs/ajer.v58i3.55631","title":"The Grade 3 Provincial Achievement Tests: In Need of Revamping?","year":2012,"lang":"en","type":"article","venue":"Alberta Journal of Educational Research","topic":"Second Language Acquisition and Learning","field":"Psychology","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Vocabulary; Argument (complex analysis); Diversity (politics); Mathematics education; Immigration; Psychology; Language proficiency; English language; Pedagogy; Linguistics; Sociology; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002915316,0.00006015188,0.0001162155,0.0002985915,0.0001327798,0.0000232753,0.0003217218,0.00004878696,0.03661069],"category_scores_gemma":[0.006078343,0.00004156479,0.00006261246,0.000369186,0.0001232692,0.0001370197,0.00003681039,0.0005487789,0.0001884729],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001136388,"about_ca_system_score_gemma":0.0003416313,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001005393,"about_ca_topic_score_gemma":0.0002725936,"domain_scores_codex":[0.9980614,0.0005926065,0.000447836,0.0000764402,0.0004573172,0.0003643566],"domain_scores_gemma":[0.9881557,0.0110436,0.000214896,0.0001765746,0.0002862405,0.0001229342],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004870415,0.002128994,0.7073451,0.00003353715,0.0001576154,0.000002438254,0.02637895,0.000008257804,0.00216662,0.2041707,0.05337284,0.003747831],"study_design_scores_gemma":[0.0008055401,0.0002624667,0.8915341,0.00008430282,0.00001079739,0.0001142342,0.01574703,0.00000350089,0.0001698317,0.0006979741,0.09048401,0.00008622606],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9378232,0.006464481,9.844678e-7,0.01393875,0.0005566762,0.0001289201,7.199285e-7,2.401176e-7,0.04108598],"genre_scores_gemma":[0.9835266,0.00002211754,0.00004437061,0.0003980479,0.0009398036,0.00001538607,0.000003003277,0.000009521003,0.01504114],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2034728,"threshold_uncertainty_score":0.96427,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08155146017497546,"score_gpt":0.4561159727900016,"score_spread":0.3745645126150262,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}