{"id":"W1991701363","doi":"10.1111/1540-4781.00137","title":"Decision Making while Rating ESL/EFL Writing Tasks: A Descriptive Framework","year":2002,"lang":"en","type":"article","venue":"Modern Language Journal","topic":"EFL/ESL Teaching and Learning","field":"Arts and Humanities","cited_by":236,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institute for Christian Studies","funders":"","keywords":"Test of English as a Foreign Language; Active listening; Psychology; Think aloud protocol; Protocol analysis; Test (biology); Descriptive statistics; Mathematics education; Writing assessment; Reading (process); Exploratory research; Linguistics; Computer science; Language assessment","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03973825,0.00102226,0.0005705694,0.006114862,0.001725059,0.00420118,0.001617042,0.0008061462,0.0008767747],"category_scores_gemma":[0.06349013,0.0006106942,0.0006568199,0.003377922,0.004149497,0.00293175,0.002195236,0.001034975,0.0003966338],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00349657,"about_ca_system_score_gemma":0.004460693,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004881744,"about_ca_topic_score_gemma":0.005495695,"domain_scores_codex":[0.9763904,0.01263501,0.003965267,0.002111287,0.004287466,0.0006105734],"domain_scores_gemma":[0.907464,0.0610889,0.01228839,0.005603388,0.01279559,0.0007597557],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"qualitative","study_design_scores_codex":[0.000510659,0.001510491,0.4594897,0.00137952,0.0001889683,0.0008902586,0.1296397,0.0106123,0.01168447,0.07640355,0.004049459,0.3036409],"study_design_scores_gemma":[0.0002233169,0.002847529,0.5378613,0.00192744,0.0002497172,0.002915168,0.1421505,0.09378235,0.02920079,0.1211702,0.06691433,0.0007574314],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6636742,0.0009245861,0.3032657,0.001698108,0.00005000281,0.005955809,0.0029873,0.0004270728,0.02101716],"genre_scores_gemma":[0.7539479,0.0004316746,0.2359814,0.0001838694,0.00003010487,0.006326387,0.001745363,0.00005349207,0.001299837],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03973825,"threshold_uncertainty_score":0.2101585,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04833117962473061,"score_gpt":0.2782858427122726,"score_spread":0.229954663087542,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}