{"id":"W7115033889","doi":"","title":"Modern type error localization in education","year":2025,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Haskell; Functional programming; Compiler; Context (archaeology); Set (abstract data type); Source code; Type inference; Satisfiability modulo theories; Focus (optics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.006399552,0.0006151538,0.0009858187,0.003167396,0.0006920092,0.0002800278,0.00171702,0.0009758101,0.0004491906],"category_scores_gemma":[0.118921,0.0005746515,0.0002712743,0.008069284,0.00003698309,0.0008020191,0.0001950668,0.001286538,0.0003166697],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006919723,"about_ca_system_score_gemma":0.0004233581,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004930216,"about_ca_topic_score_gemma":0.001843695,"domain_scores_codex":[0.9923462,0.001397038,0.001954279,0.001737267,0.001914057,0.0006511465],"domain_scores_gemma":[0.9887605,0.006861382,0.001166611,0.001363038,0.001624836,0.0002236779],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001540712,0.0002223297,0.00081451,0.0001072895,0.0000319582,0.000008814792,0.00001636706,0.0007806577,0.001032309,0.0218218,0.0001481303,0.9748617],"study_design_scores_gemma":[0.0008402584,0.0001651218,0.0144688,0.00105989,0.000114092,0.00001196976,0.001982227,0.004108346,0.00382677,0.7927527,0.1793129,0.001356845],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6698626,0.001714382,0.00003059842,0.00004326323,0.01018826,0.000859526,0.0001846322,0.0002235692,0.3168932],"genre_scores_gemma":[0.9432825,0.0003602527,0.005389341,0.0006553793,0.00008697387,0.0001251323,0.0007459711,0.0001034749,0.04925091],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9735049,"threshold_uncertainty_score":0.9996705,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2160067007646173,"score_gpt":0.4233298324420958,"score_spread":0.2073231316774785,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}