{"id":"W4384928612","doi":"10.1002/tesq.3248","title":"Evaluating the Application of a Gap‐Fill Exercise on the Learning of Phrasal Verbs: Do Errors Help or Hinder Learning?","year":2023,"lang":"en","type":"article","venue":"TESOL Quarterly","topic":"Second Language Acquisition and Learning","field":"Psychology","cited_by":11,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"","keywords":"Recall; Mainstream; Logistic regression; Psychology; Key (lock); Computer science; Cognitive psychology; Natural language processing; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005216321,0.0006253318,0.0008441487,0.0003683928,0.0002663757,0.0008485719,0.0007655687,0.0008022395,0.001986507],"category_scores_gemma":[0.04379877,0.0003141815,0.0003711531,0.0002189444,0.0004506954,0.001064726,0.0007701467,0.0007849158,0.000461476],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002447055,"about_ca_system_score_gemma":0.0004669057,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003416225,"about_ca_topic_score_gemma":0.0004332863,"domain_scores_codex":[0.9978403,0.0009845623,0.0002430599,0.0002472369,0.0005240935,0.0001607633],"domain_scores_gemma":[0.9648055,0.02753503,0.004039029,0.001046892,0.001509276,0.001064161],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.02137069,0.04100427,0.2726685,0.002220653,0.0004613553,0.0009393682,0.02414921,0.006196703,0.1041574,0.0006004802,0.0009377153,0.5252936],"study_design_scores_gemma":[0.001548817,0.2130304,0.5448989,0.0008347079,0.001035943,0.001037745,0.01568942,0.03453152,0.1791229,0.002630916,0.005347847,0.0002908141],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9993279,0.00001774996,0.0004930177,0.00001308915,0.00000349178,0.00002836883,0.000008092188,0.00001585268,0.0000925333],"genre_scores_gemma":[0.9960917,0.00007391501,0.003180484,0.00001883876,0.000007054874,0.000145768,0.00003328835,0.00001058793,0.0004384285],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005216321,"threshold_uncertainty_score":0.02758682,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07196302325841941,"score_gpt":0.3995371549854314,"score_spread":0.327574131727012,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}