{"id":"W7100609564","doi":"","title":"16Copyright © Canadian Research &amp;amp; Development Center of Sciences and Cultures 17","year":2011,"lang":"en","type":"article","venue":"","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Test (biology); Construct (python library); Affect (linguistics); Construct validity; Language proficiency; Language assessment; Center (category theory)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01488732,0.00008603478,0.0001889641,0.00115625,0.0005084925,0.0001460275,0.0008896117,0.00006047212,0.003025682],"category_scores_gemma":[0.02377324,0.00004704291,0.00002787499,0.002405447,0.0005625756,0.000161714,0.0002043193,0.0001270764,0.0002052426],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003052345,"about_ca_system_score_gemma":0.0002664326,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.03480064,"about_ca_topic_score_gemma":0.1212464,"domain_scores_codex":[0.9971188,0.0003516522,0.0004402174,0.0004358053,0.001194939,0.0004586175],"domain_scores_gemma":[0.994009,0.004846353,0.0001001463,0.000287104,0.0004776356,0.000279733],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00001324631,0.00004959699,0.6731874,0.000005587064,0.00001370271,0.000002499879,0.004953618,8.663688e-7,0.0002724322,0.005579466,0.2516695,0.06425207],"study_design_scores_gemma":[0.0001364452,0.00003623117,0.3692464,0.00001798617,0.000001126379,0.0000115114,0.001657583,0.00001219252,0.001267868,0.02969304,0.5977914,0.0001281916],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5100008,0.0002447602,0.001030901,0.0002704335,0.0001701535,0.0001071692,0.000004598233,0.00001361168,0.4881575],"genre_scores_gemma":[0.6596979,0.00002506196,0.3253862,0.0001596433,0.00002497276,0.000004882275,7.908187e-7,0.000003475776,0.01469709],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4734604,"threshold_uncertainty_score":0.9978857,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8884788864428674,"score_gpt":0.5808004734848119,"score_spread":0.3076784129580555,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}