{"id":"W7045900711","doi":"","title":"Assessing the multilevel validity of program-level inferences based on aggregate student perceptions about their general learning","year":2014,"lang":"en","type":"other","venue":"cIRcle (University of British Columbia)","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Multilevel model; Perception; Normative; Regression analysis; Categorical variable; Data collection","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1135563,0.0005998934,0.001077791,0.004448671,0.002193037,0.003018513,0.001660456,0.0008537043,0.002306304],"category_scores_gemma":[0.3431999,0.0006732556,0.00257934,0.005318238,0.002819501,0.003864476,0.006198413,0.00249927,0.0004035939],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001831972,"about_ca_system_score_gemma":0.003011314,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01107071,"about_ca_topic_score_gemma":0.01343622,"domain_scores_codex":[0.8897446,0.06666784,0.008824799,0.008703097,0.02392036,0.002139304],"domain_scores_gemma":[0.5728142,0.2813551,0.04114152,0.05333045,0.04935804,0.002000793],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003668131,0.0004059347,0.914652,0.0004080779,0.001549208,0.00006969621,0.01310442,0.001594932,0.001017965,0.006480536,0.001486546,0.05886378],"study_design_scores_gemma":[0.00008175571,0.001289063,0.9512744,0.0005235157,0.0005970447,0.00007576787,0.01116823,0.01719806,0.003072755,0.009308948,0.005309795,0.0001006515],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8626918,0.0003705196,0.1126155,0.001015684,0.0001442622,0.002182344,0.001996723,0.0002824904,0.01870073],"genre_scores_gemma":[0.9624456,0.0001004388,0.03343987,0.0002374853,0.00004802152,0.002286235,0.001009245,0.00004817932,0.000384937],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8864437,"threshold_uncertainty_score":0.6005502,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1149853243368761,"score_gpt":0.3688247159502342,"score_spread":0.2538393916133581,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}