{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":44,"total_is_capped":false,"direct_labels_cover":1,"predictions_cover":44,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"09153c5ce259","filters":{"venue":"Assessment & Evaluation in Higher Education"}},"results":[{"id":"W2071016044","doi":"10.1080/02602930500260688","title":"Ratings of university teacher instruction: how much do student and course characteristics really matter?","year":2005,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":119,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"University of Calgary","funders":"","keywords":"Psychology; Mathematics education; Class (philosophy); Higher education; Student teacher; Medical education; Teacher education; Medicine; Computer science","authors":[{"name":"Tanya Beran","is_ca":true},{"name":"Claudio Violato","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0842783477103564,"gpt":0.4658851886852968,"spread":0.3816068409749404,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005190423,0.000106735,0.0001476967,0.0001700495,0.0002672371,0.0001417986,0.0001701683,0.00009600392,0.002300012],"category_scores_gemma":[0.0001657496,0.0001255454,0.00002527529,0.000281424,0.0001195538,0.001173478,0.00003520302,0.0001894526,0.00001421651],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008246859,"about_ca_system_score_gemma":0.001359811,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000495892,"about_ca_topic_score_gemma":0.0002742084,"domain_scores_codex":[0.9966146,0.001669421,0.0002902458,0.0002699414,0.00101274,0.0001430338],"domain_scores_gemma":[0.9984021,0.0002125419,0.0005739767,0.0001943211,0.0005502325,0.00006677974],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002027491,0.0007755606,0.8878649,0.00002169133,0.00003276488,1.364795e-7,0.01586624,0.00004213379,0.0001945648,0.0353496,0.002755075,0.05707701],"study_design_scores_gemma":[0.0005164538,0.00002854161,0.9531043,0.00004244875,0.0001032299,5.202286e-7,0.01525056,0.0002370634,0.00000654631,0.0004234954,0.03016779,0.0001190846],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9186757,0.00007499132,0.00002773903,0.05601809,0.0007618575,0.0005432308,0.00000223553,0.00002477302,0.02387143],"genre_scores_gemma":[0.9895203,0.00008000387,0.003822316,0.0001561987,0.0003747596,0.00002767887,0.00003491464,0.000009154647,0.005974741],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.07084458,"threshold_uncertainty_score":0.998612,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1977788398","doi":"10.1080/02602930903337612","title":"Student satisfaction with Canadian music programmes: the application of the American Customer Satisfaction Model in higher education","year":2010,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Customer Service Quality and Loyalty","field":"Business, Management and Accounting","cited_by":66,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"Lakehead University","funders":"","keywords":"Loyalty; Customer satisfaction; Psychology; Higher education; Word of mouth; Marketing; Quality (philosophy); Minor (academic); Social psychology; Advertising; Business; Political science","authors":[{"name":"Alexander Serenko","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04703466291038546,"gpt":0.3601511729886637,"spread":0.3131165100782783,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001813512,0.0002309513,0.0002300429,0.0005255939,0.000235372,0.0002141673,0.000311094,0.00009609319,0.000626803],"category_scores_gemma":[0.00002098573,0.0001644206,0.00005692916,0.00195276,0.0001129852,0.0009765695,0.0000424889,0.0004577268,0.00003949192],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007393732,"about_ca_system_score_gemma":0.00170282,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.3233404,"about_ca_topic_score_gemma":0.6469361,"domain_scores_codex":[0.9975044,0.0001685477,0.0006228954,0.0004303332,0.000993664,0.0002801483],"domain_scores_gemma":[0.9976273,0.00005964473,0.0009011124,0.0007042245,0.0006766936,0.00003100958],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001639927,0.000389647,0.895443,0.00005811855,0.00001572543,2.464036e-8,0.0003035204,0.003315595,0.0004420559,0.03739421,0.00056611,0.0620556],"study_design_scores_gemma":[0.000356167,0.00001089222,0.9804933,0.0000478791,0.0001179279,4.352682e-7,0.001225434,0.009039901,0.000006799437,0.003094138,0.005407534,0.000199591],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9773761,0.00002193845,0.00003597422,0.01211115,0.001722687,0.002262697,0.000002137328,0.00002850305,0.006438832],"genre_scores_gemma":[0.9937403,0.00000331853,0.0004034633,0.002723924,0.0005863154,0.002037015,0.0001139098,0.00002993151,0.0003617928],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3235956,"threshold_uncertainty_score":0.6863053,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2055314676","doi":"10.1080/02602930601122555","title":"Assessment purposes and procedures in ESL/EFL classrooms","year":2007,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":61,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"University of Alberta; Queen's University","funders":"Beijing Foreign Studies University","keywords":"Psychology; Mathematics education; Pedagogy; Teaching method; Linguistics","authors":[{"name":"Liying Cheng","is_ca":true},{"name":"W. Todd Rogers","is_ca":true},{"name":"Xiaoying Wang","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07152919239186825,"gpt":0.4767516717717072,"spread":0.4052224793798389,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006380016,0.0002066542,0.0002329562,0.0005510771,0.0002664238,0.0002343697,0.0002334461,0.0001758988,0.001826685],"category_scores_gemma":[0.0001191503,0.0002212384,0.00004040911,0.0009773329,0.0001323535,0.0007661438,0.00005259586,0.0002741425,0.00001449221],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001666128,"about_ca_system_score_gemma":0.002593879,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001158552,"about_ca_topic_score_gemma":0.006333088,"domain_scores_codex":[0.9964021,0.0005053334,0.0006263299,0.0005043023,0.001464096,0.0004978437],"domain_scores_gemma":[0.9987444,0.0003447536,0.0002540711,0.0002132239,0.000313643,0.0001299681],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001061162,0.0006764329,0.9030169,0.0000252937,0.00001268116,8.216687e-7,0.004026949,0.00003370775,0.0002119078,0.07217859,0.0007105648,0.0190955],"study_design_scores_gemma":[0.0008387013,0.00005248858,0.9664642,0.00008957901,0.0000364352,3.73312e-7,0.01348338,0.0001843037,0.000007552866,0.00654562,0.01205415,0.0002432212],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8048983,0.0004378584,0.0000853541,0.004960719,0.001898643,0.001785525,0.000001002162,0.00005542497,0.1858771],"genre_scores_gemma":[0.9912133,0.0002233521,0.002844332,0.0003614158,0.0004887061,0.0005173077,0.00004835707,0.00001928427,0.004283909],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.186315,"threshold_uncertainty_score":0.9990858,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1963676041","doi":"10.1080/02602930600760884","title":"Reflections on using journals in higher education: a focus group discussion with faculty","year":2006,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Reflective Practices in Education","field":"Social Sciences","cited_by":61,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Lakehead University","funders":"Lakehead University","keywords":"Journaling file system; Reflective writing; Focus group; Higher education; Psychology; Journal writing; Medical education; Writing process; Pedagogy; Experiential learning; Professional writing; Narrative; Mathematics education; Teaching method; Sociology; Medicine; Computer science; Political science","authors":[{"name":"Timothy S. O’Connell","is_ca":true},{"name":"Janet Dyment","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2605944079125455,"gpt":0.5788218747837022,"spread":0.3182274668711567,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003145733,0.0002551235,0.0002318365,0.0009041,0.000639004,0.0003937722,0.0002510124,0.0002014908,0.003703234],"category_scores_gemma":[0.0001189461,0.0002087393,0.00005655272,0.002390315,0.0001128916,0.001946116,0.00002265464,0.0004886982,0.00003088341],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006410132,"about_ca_system_score_gemma":0.005192076,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007600913,"about_ca_topic_score_gemma":0.006010008,"domain_scores_codex":[0.9948213,0.001864771,0.0006818863,0.0006104522,0.001607414,0.0004142307],"domain_scores_gemma":[0.9978522,0.0002049112,0.0006881005,0.0003715843,0.0007719143,0.0001112746],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001547254,0.01062873,0.5118119,0.00003833056,0.00004901589,0.000001062735,0.009958451,0.008222542,0.002437635,0.3810696,0.005435952,0.07019205],"study_design_scores_gemma":[0.0006135693,0.00009616819,0.8716769,0.0002910148,0.0000791557,0.000001988256,0.005174669,0.0001334738,0.0000280689,0.06001298,0.06157646,0.0003155051],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.4217473,0.0004013857,0.0002610183,0.06164236,0.008151811,0.002524839,0.000003953135,0.00008770179,0.5051796],"genre_scores_gemma":[0.9781502,0.00002643445,0.00897337,0.0003632474,0.00193126,0.001138891,0.0001534242,0.00003556165,0.009227595],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.5564029,"threshold_uncertainty_score":0.9990076,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2087036401","doi":"10.1080/02602930902862842","title":"Bases of competence: an instrument for self and institutional assessment","year":2009,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Higher Education and Employability","field":"Social Sciences","cited_by":48,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Guelph","funders":"","keywords":"Competence (human resources); Psychology; Self-assessment; Medical education; Pedagogy; Mathematics education; Social psychology; Medicine","authors":[{"name":"Iris Berdrow","is_ca":false},{"name":"Frederick T. Evers","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1171535369150104,"gpt":0.4856852979474642,"spread":0.3685317610324538,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002865293,0.0001176669,0.0001674722,0.0001843616,0.0003179695,0.00007814064,0.0001434681,0.00008616473,0.0008086551],"category_scores_gemma":[0.00006866425,0.0001257507,0.00003616064,0.0003540881,0.000124371,0.0006072007,0.00000983201,0.00009020011,0.00000163174],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009732373,"about_ca_system_score_gemma":0.004667391,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005250796,"about_ca_topic_score_gemma":0.0001995103,"domain_scores_codex":[0.9977342,0.0005418857,0.0004447951,0.0003290341,0.0007527337,0.0001973539],"domain_scores_gemma":[0.9986805,0.0001617387,0.0001997496,0.0002133033,0.0006203313,0.0001243446],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.00001425856,0.002884964,0.3789487,0.00003670358,0.0000134705,3.307641e-8,0.005252329,0.000198367,0.0003797681,0.5584859,0.0005159489,0.05326954],"study_design_scores_gemma":[0.0005451702,0.0001663123,0.9545297,0.00003473203,0.00003857011,2.007583e-7,0.001372501,0.000694976,0.0000223036,0.02815345,0.01430836,0.0001337393],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9704791,0.00007742354,0.0004461841,0.012849,0.001449156,0.001561712,0.000008003119,0.00004712643,0.01308227],"genre_scores_gemma":[0.9605995,0.00003683104,0.03779532,0.0004895092,0.0002458031,0.0004307081,0.0001553455,0.000005190679,0.0002417625],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.575581,"threshold_uncertainty_score":0.8854206,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1981924652","doi":"10.1080/02602938.2011.630977","title":"Assessing the psychometric properties of Kember and Leung’s Reflection Questionnaire","year":2011,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Reflective Practices in Education","field":"Social Sciences","cited_by":47,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"Western University","funders":"","keywords":"Psychology; Reflective thinking; Confirmatory factor analysis; Test (biology); Construct validity; Critical thinking; Reflection (computer programming); Construct (python library); Nurse education; Reliability (semiconductor); Reflective practice; Medical education; Psychometrics; Pedagogy; Medicine; Structural equation modeling; Clinical psychology","authors":[{"name":"Kristen Lethbridge","is_ca":true},{"name":"Mary‐Anne Andrusyszyn","is_ca":true},{"name":"Carroll Iwasiw","is_ca":true},{"name":"Heather K. Spence Laschinger","is_ca":true},{"name":"Rajulton Fernando","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3077723684892498,"gpt":0.5370573176723951,"spread":0.2292849491831452,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004796715,0.0001052798,0.00011325,0.0003942795,0.0003830366,0.0001571332,0.0001533181,0.00009627676,0.0004605447],"category_scores_gemma":[0.0005938518,0.00008629344,0.00002570373,0.001355388,0.0002099455,0.001882819,0.00001917399,0.0001887501,0.000005922417],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000839013,"about_ca_system_score_gemma":0.00167379,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003528966,"about_ca_topic_score_gemma":0.0004004642,"domain_scores_codex":[0.9967261,0.001720543,0.0003804612,0.0002701501,0.0007390037,0.0001637459],"domain_scores_gemma":[0.9983978,0.00009824097,0.0004486026,0.0002322271,0.0007809096,0.0000422638],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001496622,0.0008027091,0.7758512,0.00004262673,0.0000266016,2.496768e-8,0.0308711,0.00001520382,0.001402383,0.05676284,0.0003324242,0.1338779],"study_design_scores_gemma":[0.0001543197,0.00003147993,0.9691465,0.0001068743,0.00006503098,6.830927e-7,0.008891859,0.0001290681,0.0002559073,0.01801408,0.003102567,0.0001016434],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.831743,0.001245291,0.0001489077,0.003441215,0.004223568,0.0008743808,1.315627e-7,0.00002930642,0.1582942],"genre_scores_gemma":[0.9953549,0.0001935544,0.002455517,0.0001047671,0.0002772835,0.0004929447,0.000004168425,0.00001181592,0.00110507],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1932952,"threshold_uncertainty_score":0.5334764,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1841123149","doi":"10.1080/02602938.2015.1044421","title":"Whose feedback? A multilevel analysis of student completion of end-of-term teaching evaluations","year":2015,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":41,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"University of British Columbia","funders":"","keywords":"Respondent; Set (abstract data type); Psychology; Quality (philosophy); Quality assurance; Term (time); Higher education; Medical education; Multilevel model; Course evaluation; Mathematics education; Computer science; Medicine; Political science","authors":[{"name":"Leah P. Macfadyen","is_ca":true},{"name":"Shane Dawson","is_ca":false},{"name":"Stewart Prest","is_ca":true},{"name":"Dragan Gašević","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4085236037266901,"gpt":0.6050658361994158,"spread":0.1965422324727257,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.02040448,0.0001502903,0.0004451743,0.001184331,0.0001663858,0.00004851677,0.0003628785,0.0001130151,0.00147546],"category_scores_gemma":[0.001344601,0.000166411,0.0001396891,0.001246652,0.0001835577,0.0008571519,0.00005361857,0.0002162413,0.000005868434],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001163612,"about_ca_system_score_gemma":0.003532922,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004774563,"about_ca_topic_score_gemma":0.001090211,"domain_scores_codex":[0.9906278,0.004363454,0.001189572,0.0003380206,0.003290223,0.0001909309],"domain_scores_gemma":[0.994328,0.001011391,0.001739525,0.0004280951,0.002392778,0.0001002392],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002966994,0.002833675,0.8001143,0.00004083569,0.0004636079,4.526565e-8,0.05081913,0.0188165,0.001647892,0.08905154,0.0003765268,0.03580624],"study_design_scores_gemma":[0.0008343612,0.00009101739,0.9699257,0.00009525783,0.001579385,6.684686e-8,0.01089885,0.0133635,0.00006608642,0.002276757,0.0007276679,0.0001413169],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9758937,0.0001935192,0.001496157,0.00298803,0.001151217,0.001193507,0.00001484374,0.00002433407,0.01704464],"genre_scores_gemma":[0.9876195,0.00001916975,0.01126488,0.00004333248,0.0001080378,0.0002343318,0.0002797709,0.00001242274,0.0004185548],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1698114,"threshold_uncertainty_score":0.9994373,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1996403924","doi":"10.1080/02602930701772788","title":"An investigation into electronic‐source plagiarism in a first‐year essay assignment","year":2008,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":40,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"Inyuvesi Yakwazulu-Natali","keywords":"Acknowledgement; Ignorance; The Internet; Quarter (Canadian coin); Perception; Psychology; Electronic publishing; Sociology; Pedagogy; Mathematics education; Public relations; Political science; Computer science; World Wide Web; History; Law","authors":[{"name":"Karen Ellery","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04937258231995657,"gpt":0.3927665071328492,"spread":0.3433939248128927,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006481186,0.0001611056,0.0001662171,0.0003462539,0.0004610901,0.00007014809,0.0002922805,0.0006216856,0.001189769],"category_scores_gemma":[0.0001890699,0.0001838638,0.00003403608,0.0007345208,0.0001513609,0.0008130647,0.00001935646,0.001087149,0.00004557382],"about_ca_system_candidate":true,"about_ca_system_consensus":true,"about_ca_system_score_codex":0.003836043,"about_ca_system_score_gemma":0.005797246,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01168787,"about_ca_topic_score_gemma":0.005671833,"domain_scores_codex":[0.9956521,0.00173828,0.0004848463,0.0004327987,0.001289792,0.0004021836],"domain_scores_gemma":[0.9989063,0.0002183591,0.0002233108,0.0002461041,0.0002779911,0.0001279337],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002349572,0.0006324825,0.7560186,0.00001523807,0.00001345374,5.481709e-7,0.09498713,0.003501525,0.0003307586,0.1341693,0.00407434,0.006233157],"study_design_scores_gemma":[0.0008758753,0.0001164708,0.8673861,0.00009988211,0.00003116811,0.000001202156,0.01249727,0.004785337,0.00008762802,0.07870213,0.03503885,0.0003780698],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.971504,0.0001677653,0.000886619,0.01461203,0.0009985224,0.0010567,8.386366e-7,0.00005665807,0.0107169],"genre_scores_gemma":[0.9937228,0.0001769725,0.001990321,0.0006270838,0.000500657,0.0005546119,0.0001751202,0.00001659367,0.002235852],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1113675,"threshold_uncertainty_score":0.9999881,"prediction_status":"machine_predicted_unvalidated"},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["research_integrity"],"domain":null,"study_design":"design_other","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W3092685673","doi":"10.1080/02602938.2020.1826900","title":"When academic integrity rules should not apply: a survey of academic staff","year":2020,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":30,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Centre for Social Innovation","funders":"","keywords":"Academic integrity; Ambiguity; Public relations; Compliance (psychology); Ideology; Psychology; Multinational corporation; Welfare; Social psychology; Action (physics); Political science; Law","authors":[{"name":"Alexander Amigud","is_ca":true},{"name":"David J. Pell","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2955925821472836,"gpt":0.4864898433562915,"spread":0.1908972612090079,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["research_integrity","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01216191,0.0001938528,0.0003236687,0.0001864435,0.000181352,0.0000408545,0.0006084289,0.001223458,0.003242515],"category_scores_gemma":[0.002041222,0.0002040317,0.00006068025,0.0007108769,0.0001987535,0.0007093017,0.00006603642,0.003856067,0.00007366654],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007525152,"about_ca_system_score_gemma":0.004784932,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01322274,"about_ca_topic_score_gemma":0.0005624033,"domain_scores_codex":[0.9934456,0.002997414,0.000864685,0.0004684939,0.001873041,0.0003507667],"domain_scores_gemma":[0.9973081,0.0009563434,0.0005130613,0.0001897045,0.0008469573,0.0001858509],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001432821,0.0004138091,0.5919715,0.0001157731,0.00006234446,2.500081e-7,0.05852202,0.0001940595,0.001817366,0.2294398,0.04985595,0.06746379],"study_design_scores_gemma":[0.0005686284,0.00007697776,0.9205915,0.0001544115,0.00009481848,2.147881e-7,0.007914933,0.002962116,0.0002670215,0.03433935,0.03266172,0.0003682545],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8558592,0.000766315,0.001059241,0.1105199,0.002420065,0.001973098,0.00009016001,0.0001080223,0.02720394],"genre_scores_gemma":[0.994217,0.0004041111,0.001249885,0.002197394,0.0006097556,0.000229976,0.0003614761,0.0000171722,0.0007132797],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.32862,"threshold_uncertainty_score":0.9984421,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4402918453","doi":"10.1080/02602938.2024.2404634","title":"Authentic assessment: from panacea to criticality","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":27,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ontario Tech University","funders":"","keywords":"Panacea (medicine); Psychology; Criticality; Pedagogy; Mathematics education","authors":[{"name":"Tim Fawns","is_ca":false},{"name":"Margaret Bearman","is_ca":false},{"name":"Phillip Dawson","is_ca":false},{"name":"Juuso Henrik Nieminen","is_ca":true},{"name":"Kevin Ashford-Rowe","is_ca":false},{"name":"Keith Willey","is_ca":false},{"name":"Lasse X Jensen","is_ca":false},{"name":"Crina Damşa","is_ca":false},{"name":"Nona Press","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0740774940749726,"gpt":0.5029731262640805,"spread":0.4288956321891079,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002343541,0.000215657,0.0002682106,0.0006807264,0.00009390739,0.0001866106,0.0001436571,0.0001664734,0.01181993],"category_scores_gemma":[0.000382907,0.0002148305,0.00007140153,0.001729059,0.00005498118,0.0003732805,0.0000396454,0.0005017162,0.0003609374],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002648064,"about_ca_system_score_gemma":0.003642146,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000242251,"about_ca_topic_score_gemma":0.00001153062,"domain_scores_codex":[0.9965072,0.0003008,0.0007675593,0.0006770948,0.001438571,0.0003087299],"domain_scores_gemma":[0.9982798,0.0002088346,0.00007415086,0.0006040218,0.0007093041,0.0001239244],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00004532932,0.004238204,0.1553859,0.0006849106,0.0002403712,0.000008485202,0.002604673,0.0001326707,0.005715792,0.2427939,0.1452451,0.4429046],"study_design_scores_gemma":[0.0004960314,0.00009284514,0.9086346,0.0006931523,0.0003225308,0.00000338665,0.0006947176,0.01644737,0.00006986879,0.01967533,0.0526465,0.0002236798],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8427647,0.0005035729,0.004650086,0.1048408,0.01161184,0.002290393,0.00001458931,0.0002277837,0.03309628],"genre_scores_gemma":[0.9645715,0.00001284762,0.02364283,0.004905685,0.001134209,0.001494644,0.001236819,0.00004073068,0.002960742],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7532488,"threshold_uncertainty_score":0.9890834,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3095117930","doi":"10.1080/02602938.2020.1836123","title":"University students’ negative emotions in a computer-based examination: the roles of trait test-emotion, prior test-taking methods and gender","year":2020,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Education, Achievement, and Giftedness","field":"Psychology","cited_by":27,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University; Concordia University; McGill University Health Centre; University of Alberta","funders":"","keywords":"Test anxiety; Psychology; Test (biology); Trait; Anxiety; Social psychology; Computer science","authors":[{"name":"Jason M. Harley","is_ca":true},{"name":"Nigel Mantou Lou","is_ca":true},{"name":"Yang S. Liu","is_ca":true},{"name":"Maria Cutumisu","is_ca":true},{"name":"Lia M. Daniels","is_ca":true},{"name":"Jacqueline P. Leighton","is_ca":true},{"name":"Lindsey Nadon","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1558725960589381,"gpt":0.4787915717209989,"spread":0.3229189756620608,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002578935,0.0001659695,0.0001981705,0.0002929714,0.0001488203,0.00005132639,0.000259048,0.00009309115,0.001073478],"category_scores_gemma":[0.000252471,0.0001634198,0.00003879983,0.001014429,0.0001003578,0.0002514666,0.00003766836,0.0002044209,0.000003671428],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003540909,"about_ca_system_score_gemma":0.0006176085,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001212947,"about_ca_topic_score_gemma":0.0001111789,"domain_scores_codex":[0.9964742,0.002008651,0.000439491,0.0004432782,0.000466174,0.0001682141],"domain_scores_gemma":[0.9971409,0.001578279,0.0005035223,0.0002662988,0.0004472786,0.00006364824],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001224578,0.002268471,0.9149113,0.00005743563,0.00004016311,2.73323e-7,0.03169452,0.0006916182,0.0002597578,0.005762797,0.00030033,0.04400109],"study_design_scores_gemma":[0.001487975,0.0001505436,0.9782522,0.00005039351,0.000109716,4.593174e-7,0.0133634,0.005070062,0.00002638128,0.001112737,0.0002333067,0.0001428051],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9731333,0.00008922382,0.01391572,0.00865351,0.0007830469,0.001417899,0.00001350968,0.00002890001,0.001964866],"genre_scores_gemma":[0.9847099,0.000008916511,0.01418675,0.0004448599,0.0001706289,0.0001361725,0.00009614452,0.00001460251,0.0002320343],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.06334092,"threshold_uncertainty_score":0.9998397,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3172383618","doi":"10.1080/02602938.2021.1912286","title":"Student satisfaction with use of an online peer feedback system","year":2021,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Team Dynamics and Performance","field":"Psychology","cited_by":26,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary; University of Ottawa","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Teamwork; Peer feedback; Psychology; Team composition; Higher education; Social loafing; Curriculum; Knowledge management; Medical education; Computer science; Mathematics education; Pedagogy; Social psychology; Political science","authors":[{"name":"Magda Donia","is_ca":true},{"name":"Mercè Mach","is_ca":false},{"name":"Tom O’Neill","is_ca":true},{"name":"Stéphane Brutus","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1241615861287017,"gpt":0.4555730438109025,"spread":0.3314114576822008,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0006303422,0.0001181382,0.0001577663,0.0001376584,0.00004321983,0.00005601376,0.00006361989,0.00008076928,0.001737194],"category_scores_gemma":[0.000007567073,0.0001127281,0.00002369075,0.000364582,0.00001844975,0.0003924784,0.00001405045,0.0001371911,0.00001563032],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005097797,"about_ca_system_score_gemma":0.0006110391,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009318502,"about_ca_topic_score_gemma":0.001114163,"domain_scores_codex":[0.9980484,0.000398285,0.0003886875,0.0003105729,0.0007185931,0.0001354556],"domain_scores_gemma":[0.9982901,0.00005829377,0.0002540358,0.0004334117,0.0009192398,0.00004495651],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00003808444,0.001471993,0.9449684,0.000047741,0.00005627951,0.000001179406,0.001379311,0.002788877,0.0003354123,0.02185388,0.0003634804,0.02669537],"study_design_scores_gemma":[0.0007588626,0.0001350393,0.9897222,0.00008494197,0.00007715378,0.000007929747,0.003780826,0.004292025,0.00001401403,0.00007390066,0.000930791,0.0001223243],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9932513,0.00006786111,0.0001371651,0.0007595174,0.00238971,0.0004556335,0.00001678233,0.00002525601,0.002896761],"genre_scores_gemma":[0.9916502,0.000005895205,0.003848315,0.00009404783,0.0001689539,0.0002295423,0.0007868996,0.00001866182,0.003197499],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0447538,"threshold_uncertainty_score":0.9991754,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2762181356","doi":"10.1080/02602938.2017.1380161","title":"Team dynamics feedback for post-secondary student learning teams","year":2017,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Team Dynamics and Performance","field":"Psychology","cited_by":25,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa; University of Calgary","funders":"","keywords":"Psychology; Team composition; Team effectiveness; Context (archaeology); Medical education; Health care; Teamwork; Suite; Perception; Applied psychology; Knowledge management; Computer science; Medicine; Social psychology","authors":[{"name":"Tom O’Neill","is_ca":true},{"name":"Amanda Deacon","is_ca":true},{"name":"Katherine Gibbard","is_ca":true},{"name":"Nicole Larson","is_ca":true},{"name":"Genevieve Hoffart","is_ca":true},{"name":"Julia Smith","is_ca":true},{"name":"B. L. M. Donia","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04679159502534595,"gpt":0.4609525818626039,"spread":0.4141609868372579,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001691671,0.0001805821,0.000188652,0.0001731845,0.0004765789,0.0002465595,0.0003973843,0.000145147,0.003077293],"category_scores_gemma":[0.00004831043,0.0001923392,0.00006834862,0.00007995929,0.00004854059,0.00042893,0.00005707988,0.0003364417,0.00009762841],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008931723,"about_ca_system_score_gemma":0.000801875,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004219112,"about_ca_topic_score_gemma":0.0002820446,"domain_scores_codex":[0.9982435,0.0001896096,0.0004263474,0.0004326492,0.0004144806,0.0002934718],"domain_scores_gemma":[0.9982351,0.0001104981,0.0004944556,0.0006641327,0.0004340958,0.00006168448],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00004707131,0.0008967894,0.734304,0.00004028624,0.00005990804,1.7518e-7,0.001777864,0.000439302,0.00008813894,0.04995244,0.002490707,0.2099033],"study_design_scores_gemma":[0.001377877,0.0001991643,0.9642575,0.00003893341,0.00005659409,0.000001432181,0.002372024,0.01515403,0.000001869409,0.00199037,0.01433049,0.0002196829],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8732196,0.0001605644,0.0002958827,0.003598447,0.007551393,0.001386987,0.0000186649,0.00003908583,0.1137294],"genre_scores_gemma":[0.9741002,0.00001662282,0.001079773,0.000262167,0.0004581806,0.00152206,0.0007290677,0.00003486225,0.02179706],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2299535,"threshold_uncertainty_score":0.997834,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3008488197","doi":"10.1080/02602938.2020.1727412","title":"Team dynamics feedback for post-secondary student learning teams: introducing the “Bare CARE” assessment and report","year":2020,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Team Dynamics and Performance","field":"Psychology","cited_by":22,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"","keywords":"Formative assessment; Teamwork; Psychology; Experiential learning; Medical education; Health care; Sample (material); Applied psychology; Pedagogy; Medicine","authors":[{"name":"Tom O’Neill","is_ca":true},{"name":"Leah Pezer","is_ca":true},{"name":"Lorena Solis","is_ca":true},{"name":"Nicole Larson","is_ca":true},{"name":"Nicoleta Maynard","is_ca":false},{"name":"Glenn Dolphin","is_ca":true},{"name":"Robert W. Brennan","is_ca":true},{"name":"Simon Li","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03439414168239335,"gpt":0.4298549881584132,"spread":0.3954608464760198,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001698325,0.0002156996,0.0002275335,0.000113495,0.0002893962,0.0001648668,0.0002155826,0.0001141865,0.0007342297],"category_scores_gemma":[0.00005665883,0.000190028,0.00005821407,0.0002710219,0.00004534858,0.0002477685,0.00007651246,0.0005185651,0.00001137744],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001083969,"about_ca_system_score_gemma":0.001269985,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002115744,"about_ca_topic_score_gemma":0.0001032839,"domain_scores_codex":[0.9975747,0.0003778272,0.0006153611,0.000635725,0.0005215376,0.0002748227],"domain_scores_gemma":[0.9984483,0.0002041497,0.0003073896,0.000401638,0.0005548076,0.0000837628],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00005230491,0.0003943611,0.8335823,0.0001528088,0.000116802,0.000001343788,0.01954166,0.003025383,0.0001983685,0.01545287,0.003224574,0.1242573],"study_design_scores_gemma":[0.0009500376,0.0003030207,0.9268766,0.00003501498,0.0001109978,0.000009239382,0.03468575,0.02393527,0.000001990701,0.0002444577,0.01262757,0.0002200648],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9560162,0.0007550064,0.000979,0.01882357,0.003396472,0.002218405,0.00001974363,0.00005729081,0.01773435],"genre_scores_gemma":[0.9925658,0.00002818196,0.001894297,0.00104079,0.0006845506,0.001438314,0.001260521,0.00003915042,0.001048387],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1240372,"threshold_uncertainty_score":0.80393,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2043118965","doi":"10.1080/02602930802082228","title":"What do students consider useful about student ratings?","year":2008,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":21,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"University of Calgary","funders":"","keywords":"Psychology; Ranking (information retrieval); Reliability (semiconductor); Applied psychology; Variance (accounting); Higher education; Mathematics education; Computer science","authors":[{"name":"Tanya Beran","is_ca":true},{"name":"Claudio Violato","is_ca":true},{"name":"Don Kline","is_ca":true},{"name":"Jim Frideres","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2763681900177989,"gpt":0.581646382299723,"spread":0.305278192281924,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.009992114,0.0002014824,0.0002249998,0.0003152441,0.0008794519,0.0008341561,0.0004901264,0.0001448667,0.00695002],"category_scores_gemma":[0.0006752294,0.0002219099,0.00006383234,0.0005728517,0.0001767009,0.003662611,0.00007569054,0.0003403966,0.0002157693],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001731918,"about_ca_system_score_gemma":0.003471464,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009452125,"about_ca_topic_score_gemma":0.0004687946,"domain_scores_codex":[0.9911293,0.003260781,0.0007092284,0.0005427483,0.004008668,0.000349286],"domain_scores_gemma":[0.9970899,0.0007422422,0.0006248961,0.000414777,0.000990411,0.0001378167],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000007724738,0.001315483,0.9312668,0.000008316024,0.00004052494,0.000001018769,0.03458537,0.0004041858,0.00004423017,0.02024691,0.005934813,0.006144598],"study_design_scores_gemma":[0.000779366,0.00004054106,0.9309947,0.0001309754,0.00007495368,0.000001346154,0.01941773,0.00006560029,0.000008892374,0.002570214,0.04568034,0.0002353304],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9443405,0.00123142,0.00002145903,0.01964658,0.007676884,0.001673771,7.526365e-7,0.00009259496,0.02531599],"genre_scores_gemma":[0.9851313,0.001127507,0.001563043,0.001237419,0.0006356651,0.0007729402,0.00005091687,0.00002358553,0.009457642],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04079073,"threshold_uncertainty_score":0.9939578,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2771690381","doi":"10.1080/02602938.2017.1412397","title":"Taking stock and effecting change: curriculum evaluation through a review of course syllabi","year":2017,"lang":"en","type":"review","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":20,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true},"ca_institutions":"University of Windsor","funders":"University of Windsor","keywords":"Syllabus; Curriculum; Experiential learning; Unit (ring theory); Higher education; Medical education; Discipline; Psychology; Course evaluation; Reading (process); Pedagogy; Mathematics education; Political science; Medicine","authors":[{"name":"Adam Goodwin","is_ca":true},{"name":"Laura Chittle","is_ca":true},{"name":"Jess C. Dixon","is_ca":true},{"name":"David M. Andrews","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6459460384304073,"gpt":0.6783012568282019,"spread":0.03235521839779454,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.04082786,0.0004426508,0.001356009,0.0003473854,0.0007205781,0.0002726195,0.0005725865,0.000389898,0.002479004],"category_scores_gemma":[0.006590876,0.0004387896,0.0002275614,0.0006947123,0.0001802231,0.002100857,0.0001098374,0.0006523505,0.00002456085],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0021742,"about_ca_system_score_gemma":0.008808434,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004074303,"about_ca_topic_score_gemma":0.0003605407,"domain_scores_codex":[0.9819645,0.01182092,0.001515613,0.0008279342,0.003496041,0.0003750483],"domain_scores_gemma":[0.9891223,0.001338127,0.006582706,0.0008290108,0.002032217,0.00009566507],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[8.14951e-7,0.0003187975,0.001638016,0.02181888,0.0000751132,1.308888e-7,0.001523205,0.000001730567,9.769821e-8,0.004894115,0.0007753576,0.9689537],"study_design_scores_gemma":[0.0003706432,0.00005714439,0.01303828,0.148159,0.004900644,0.000002601106,0.0005489155,0.0002055061,6.263303e-8,0.000947176,0.8312931,0.0004769491],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0001140357,0.9608324,0.000009290876,0.003946115,0.003711878,0.009648295,0.00000647175,0.00004419705,0.02168735],"genre_scores_gemma":[0.004900793,0.9852898,0.001302128,0.0001997516,0.001100324,0.006378584,0.0004197426,0.00005085912,0.0003579966],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9684768,"threshold_uncertainty_score":0.9998064,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2962316688","doi":"10.1080/02602938.2019.1637819","title":"Voices at the gate: Faculty members’ and students’ differing perspectives on the purposes of the PhD comprehensive examination","year":2019,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Doctoral Education Challenges and Solutions","field":"Health Professions","cited_by":15,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"Simon Fraser University","funders":"","keywords":"Gatekeeping; Psychology; Medical education; Final examination; Empirical examination; Identity (music); Function (biology); Higher education; Affect (linguistics); Pedagogy; Perspective (graphical); Mathematics education; Medicine; Political science","authors":[{"name":"Sheryl Guloy","is_ca":true},{"name":"Gregory Hum","is_ca":true},{"name":"D. Kevin O’Neill","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3458290584160393,"gpt":0.5752187854825841,"spread":0.2293897270665448,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001532931,0.0001452279,0.0001532869,0.00008020776,0.0007352473,0.00003683168,0.0002762503,0.00008423984,0.003375002],"category_scores_gemma":[0.0001053332,0.00007784201,0.00004711752,0.0003060587,0.0001060562,0.0001810606,0.0001445167,0.0003456274,0.00004268277],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008648811,"about_ca_system_score_gemma":0.0004576416,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003261983,"about_ca_topic_score_gemma":0.0002306978,"domain_scores_codex":[0.9965775,0.00169666,0.0004065181,0.0002903567,0.0008389046,0.0001900453],"domain_scores_gemma":[0.9973765,0.00108092,0.0004432978,0.0004509573,0.0006148582,0.00003344724],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002991852,0.001018162,0.7996368,0.0001758388,0.0001049662,2.240699e-8,0.1005914,0.0008925124,0.000990821,0.08744289,0.006549369,0.002567276],"study_design_scores_gemma":[0.0003907192,0.00003698592,0.8891584,0.0001531399,0.0000434142,1.594708e-7,0.1020524,0.0004146793,0.00001669894,0.0005716335,0.007084589,0.00007717483],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9632757,0.0005185173,0.000001788903,0.02380107,0.002191416,0.002605771,0.00001099963,0.00001353189,0.007581252],"genre_scores_gemma":[0.9889706,0.0001506542,0.00002531631,0.0005268243,0.0001575542,0.001428537,0.00004868345,0.00001330824,0.008678489],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.08952153,"threshold_uncertainty_score":0.9975361,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2029621922","doi":"10.1080/02602930802563094","title":"Web‐based student feedback: comparing teaching‐award and research‐award recipients","year":2009,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":15,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"MacEwan University","funders":"","keywords":"Helpfulness; CLARITY; Psychology; Credibility; Competence (human resources); Medical education; Personality; Mathematics education; Pedagogy; Social psychology; Medicine; Political science","authors":[{"name":"Diane Symbaluk","is_ca":true},{"name":"Andrew J. Howell","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3379119990917349,"gpt":0.600605115458447,"spread":0.2626931163667121,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03078133,0.0001792767,0.0002268889,0.0006473067,0.001119598,0.0005615043,0.0004027112,0.0001403328,0.0006716619],"category_scores_gemma":[0.001220871,0.000198239,0.00004343622,0.0006200997,0.0001419031,0.001225211,0.00005428103,0.0007700881,0.0000606707],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002474369,"about_ca_system_score_gemma":0.002707311,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001480024,"about_ca_topic_score_gemma":0.0005430199,"domain_scores_codex":[0.9878934,0.006970679,0.0005792266,0.0005880953,0.003508679,0.0004599353],"domain_scores_gemma":[0.9973285,0.0009244484,0.0003584809,0.0003850694,0.0008239856,0.0001795634],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00004236468,0.002414393,0.785777,0.00001830387,0.00002842034,5.190512e-7,0.01536012,0.001100212,0.0004772063,0.1243767,0.01170183,0.0587029],"study_design_scores_gemma":[0.001019056,0.000116561,0.9214819,0.0001358639,0.00005012525,2.142085e-7,0.003880566,0.003702705,0.000006087618,0.007152044,0.06225311,0.0002017482],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8246219,0.0002151566,0.00006479763,0.08230612,0.00228368,0.001354231,8.516938e-7,0.00009935629,0.0890539],"genre_scores_gemma":[0.9909831,0.00005001946,0.004437692,0.0006762054,0.0004950684,0.0002834503,0.00005784664,0.00001598069,0.00300068],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1663611,"threshold_uncertainty_score":0.9980146,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3162164515","doi":"10.1080/02602938.2021.1921105","title":"Fitted: the impact of academics’ attire on students’ evaluations and intentions","year":2021,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Communication in Education and Healthcare","field":"Psychology","cited_by":15,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Victoria","funders":"","keywords":"Psychology; Higher education; Pedagogy; Mathematics education; Medical education; Medicine; Political science","authors":[{"name":"Sebastian Oliver","is_ca":false},{"name":"Ben Marder","is_ca":false},{"name":"Antonia Erz","is_ca":false},{"name":"Jan Kietzmann","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2935359884430912,"gpt":0.625609991914194,"spread":0.3320740034711028,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002065685,0.0001526988,0.0001818352,0.0002676461,0.0002180559,0.00006446451,0.0003122399,0.000136015,0.01025352],"category_scores_gemma":[0.0001837349,0.0001291801,0.00009145746,0.0008061858,0.0000884465,0.0001384747,0.0000730527,0.0004475932,0.0000453234],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006835195,"about_ca_system_score_gemma":0.002117921,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003188931,"about_ca_topic_score_gemma":0.00007032758,"domain_scores_codex":[0.9964592,0.001525474,0.0006546358,0.0003485284,0.0008249284,0.0001871633],"domain_scores_gemma":[0.9969187,0.0005905492,0.0003575915,0.0008808796,0.001174318,0.00007793168],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0000214928,0.002581197,0.8265318,0.00002202207,0.0001371217,1.299155e-7,0.007087109,0.000352888,0.0003873104,0.1076708,0.01596185,0.03924634],"study_design_scores_gemma":[0.0006249312,0.00008143154,0.9842854,0.00008976972,0.00007427849,0.000004037569,0.006667064,0.0003221835,0.00001136924,0.005856288,0.001872687,0.0001105404],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9343823,0.001672207,0.00003580886,0.02644523,0.002001499,0.00109752,0.00001612787,0.00002581922,0.03432345],"genre_scores_gemma":[0.9935219,0.0001832723,0.0003160356,0.0006740169,0.000149525,0.001270388,0.0002846041,0.00001761557,0.003582599],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1577536,"threshold_uncertainty_score":0.9906512,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1964857994","doi":"10.1080/02602938.2013.845647","title":"Student personality differences are related to their responses on instructor evaluation forms","year":2013,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Communication in Education and Healthcare","field":"Psychology","cited_by":14,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Cape Breton University","funders":"","keywords":"Agreeableness; Conscientiousness; Neuroticism; Psychology; Extraversion and introversion; Big Five personality traits; Personality; Hierarchical structure of the Big Five; Openness to experience; Regression analysis; Social psychology; Statistics; Mathematics","authors":[{"name":"Stewart J. H. McCann","is_ca":true},{"name":"Christopher D. Gardner","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2232313328683612,"gpt":0.5409676873858742,"spread":0.3177363545175129,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.003164062,0.0002805577,0.000283789,0.0006119697,0.0002733126,0.0001624086,0.0004624028,0.0001985665,0.04726952],"category_scores_gemma":[0.0001819811,0.0002515816,0.00007534096,0.0007789897,0.00005447914,0.000362696,0.0000587459,0.0004038269,0.0008732677],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001984492,"about_ca_system_score_gemma":0.0012843,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000670024,"about_ca_topic_score_gemma":0.0001795932,"domain_scores_codex":[0.994223,0.002574712,0.000911971,0.0006527987,0.001293079,0.0003444175],"domain_scores_gemma":[0.9962108,0.0005333487,0.000526882,0.001120217,0.001413583,0.0001952318],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00005586129,0.002047661,0.8340484,0.00002388542,0.00005886375,5.728836e-8,0.02030395,0.00005608205,0.000108243,0.05034884,0.007933676,0.08501448],"study_design_scores_gemma":[0.000860952,0.0001624332,0.9543015,0.0001128059,0.00003745189,0.000001189036,0.02879446,0.0003047697,0.000007334614,0.0122211,0.002937984,0.0002580275],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9104716,0.0002823521,0.000005490248,0.03537015,0.004186098,0.0037452,0.0000110365,0.00007443838,0.04585369],"genre_scores_gemma":[0.9811028,0.00002000004,0.0003718034,0.002148783,0.0001707061,0.01035176,0.0002786719,0.00003007283,0.005525397],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1202531,"threshold_uncertainty_score":0.9999936,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1904991648","doi":"10.1080/02602938.2015.1089977","title":"New assessment process in an introductory undergraduate physics laboratory: an exploration on collaborative learning","year":2015,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Innovative Teaching Methods","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University","funders":"","keywords":"Grading (engineering); Session (web analytics); Peer assessment; Process (computing); Peer evaluation; Mathematics education; Incentive; Class (philosophy); Task (project management); Higher education; Medical education; Psychology; Computer science; Engineering","authors":[{"name":"Anthony C. K. Leung","is_ca":true},{"name":"Banafsheh Hashemi Pour","is_ca":true},{"name":"Dan Reynolds","is_ca":true},{"name":"S. Jerzak","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.241407662093847,"gpt":0.5511415627937231,"spread":0.3097339006998761,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.01157368,0.000239109,0.0002560586,0.0004217394,0.0003082854,0.0003071259,0.0002693187,0.0001456073,0.0001637533],"category_scores_gemma":[0.0005361982,0.000270389,0.00001766825,0.002785109,0.00008053667,0.004420137,0.00001908424,0.0006143543,0.00001411805],"about_ca_system_candidate":true,"about_ca_system_consensus":true,"about_ca_system_score_codex":0.004259724,"about_ca_system_score_gemma":0.0153096,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006495116,"about_ca_topic_score_gemma":0.001008593,"domain_scores_codex":[0.9880824,0.008701549,0.0005193431,0.0006352573,0.00172447,0.0003369733],"domain_scores_gemma":[0.9964725,0.0001831501,0.0004804018,0.0003366178,0.002331509,0.0001958436],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.0000728856,0.002055631,0.3097641,0.00002002552,0.0000199522,6.184325e-7,0.07975242,0.05667152,0.0009680766,0.5076073,0.001308866,0.04175853],"study_design_scores_gemma":[0.0026666,0.001086224,0.6180264,0.0001692025,0.00006212309,9.631061e-8,0.09625308,0.008683151,0.0003768379,0.2629292,0.008869864,0.0008772511],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9537526,0.000040376,0.007727033,0.01219042,0.003373353,0.002074983,0.000002831779,0.0001601183,0.02067825],"genre_scores_gemma":[0.9776131,0.000008850507,0.019147,0.0002716709,0.001414404,0.0006292635,0.000325986,0.00003602064,0.0005536797],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3082622,"threshold_uncertainty_score":0.9999748,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4391679980","doi":"10.1080/02602938.2024.2312918","title":"Decolonizing academic integrity: knowledge caretaking as ethical practice","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"African cultural and philosophical studies","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"National Natural Science Foundation of China","keywords":"Academic integrity; Psychology; Pedagogy; Higher education; Engineering ethics; Medical education; Social psychology; Medicine; Political science","authors":[{"name":"Sarah Elaine Eaton","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2740578234147089,"gpt":0.5728610453092766,"spread":0.2988032218945678,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.004460434,0.0001206155,0.0001333628,0.0001205974,0.0004290072,0.0001876637,0.0001692744,0.0003380239,0.001414565],"category_scores_gemma":[0.001264723,0.0001051771,0.00004929611,0.0008066698,0.0001243008,0.0005982053,0.00004784895,0.001551517,0.0001909817],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0016734,"about_ca_system_score_gemma":0.002895803,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001272348,"about_ca_topic_score_gemma":0.0003647621,"domain_scores_codex":[0.9969395,0.001319387,0.0003215246,0.0003433973,0.0008406969,0.00023547],"domain_scores_gemma":[0.9979317,0.001257301,0.0000945641,0.00009377272,0.0005365318,0.00008619758],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000005396417,0.0001082842,0.003822,0.00002952846,0.0000293977,8.936448e-7,0.02624493,0.00001066469,0.00005492738,0.9122818,0.003817476,0.05359476],"study_design_scores_gemma":[0.0001235148,0.00004325195,0.05003035,0.0002956852,0.000145085,0.000001464681,0.01428582,0.0004223363,0.000005607356,0.1900093,0.7444143,0.0002233056],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.08663566,0.008165049,0.00003323063,0.4118496,0.005698915,0.0008448109,0.000001817066,0.0001647475,0.4866062],"genre_scores_gemma":[0.9929847,0.0004002907,0.0004793862,0.001530067,0.00154661,0.00039373,0.00002523476,0.00001022434,0.002629748],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9063491,"threshold_uncertainty_score":0.9994982,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3049736335","doi":"10.1080/02602938.2020.1805410","title":"Are students gender-neutral in their assessment of online teaching staff?","year":2020,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"","keywords":"Workload; Psychology; Construct (python library); Quality (philosophy); Promotion (chess); Medical education; Course evaluation; Higher education; Computer science; Medicine","authors":[{"name":"Jennifer S. Wong","is_ca":true},{"name":"Jessica Bouchard","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3723123297852586,"gpt":0.5823678399594441,"spread":0.2100555101741854,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.008926777,0.0001868666,0.0002999265,0.0003074734,0.0002100784,0.0001442437,0.0005204664,0.0001245778,0.001020834],"category_scores_gemma":[0.0007936854,0.0001992829,0.00006517499,0.0005867462,0.0000666512,0.001071701,0.00007837977,0.0006000428,0.000007532621],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001403595,"about_ca_system_score_gemma":0.002590379,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001415086,"about_ca_topic_score_gemma":0.00151661,"domain_scores_codex":[0.9920707,0.004293615,0.0008296034,0.0004777398,0.002035855,0.0002924342],"domain_scores_gemma":[0.997614,0.0005264218,0.0010733,0.0002628347,0.0003990551,0.0001243719],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0000130208,0.002829759,0.9365988,0.00005067554,0.00003566547,4.481958e-7,0.01832443,0.004735852,0.0002837414,0.02729322,0.0007008898,0.009133476],"study_design_scores_gemma":[0.0008066635,0.00006849294,0.9628106,0.00009641943,0.00005322093,9.463963e-8,0.02418234,0.003776573,0.00001087942,0.002465267,0.005546334,0.0001830833],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9494612,0.000110815,0.000124507,0.03274252,0.001045275,0.001211881,0.000009066344,0.00004966806,0.01524511],"genre_scores_gemma":[0.9918222,0.00004130389,0.006319608,0.0008142819,0.0003940183,0.0002123644,0.0001198742,0.0000209001,0.00025547],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04236102,"threshold_uncertainty_score":0.9998924,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4200173019","doi":"10.1080/02602938.2021.2009439","title":"Does a classroom-based curriculum offer authentic assessments? A strategy to uncover their prevalence and incorporate opportunities for authenticity","year":2021,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Guelph","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Authentic assessment; Syllabus; Curriculum; Capstone; Judgement; Psychology; Context (archaeology); Medical education; Summative assessment; Authentic learning; Mathematics education; Curriculum development; Pedagogy; Formative assessment; Medicine; Computer science","authors":[{"name":"Justine Hobbins","is_ca":true},{"name":"Bronte Kerrigan","is_ca":true},{"name":"Niloufar Farjam","is_ca":true},{"name":"Ashley Fisher","is_ca":true},{"name":"Emilie Houston","is_ca":true},{"name":"Kerry Ritchie","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1088807282250504,"gpt":0.4262251548746052,"spread":0.3173444266495547,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002034771,0.0002636006,0.000325568,0.0004265525,0.0001486163,0.0001491119,0.0001144854,0.0001563584,0.001442267],"category_scores_gemma":[0.0003809295,0.0002026159,0.00006521535,0.000830799,0.00007974487,0.000371067,0.00004430846,0.0002519513,0.000006430155],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001012847,"about_ca_system_score_gemma":0.005496587,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00003556174,"about_ca_topic_score_gemma":0.00002545379,"domain_scores_codex":[0.9970869,0.0003806864,0.0007297847,0.0006234718,0.0008678332,0.0003113659],"domain_scores_gemma":[0.9968675,0.0001654655,0.0003142077,0.0005077434,0.002021913,0.0001231261],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000172919,0.008273856,0.7249022,0.003120043,0.000240628,0.000005970592,0.001409957,0.0005223424,0.004180801,0.03368194,0.01808416,0.2054052],"study_design_scores_gemma":[0.002380855,0.0004965324,0.93418,0.0009718157,0.0004982899,0.000006074164,0.004525324,0.03330765,0.0006835983,0.01443926,0.008097338,0.0004132907],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9692516,0.0001181571,0.004160129,0.01991519,0.002665947,0.002610898,0.00002419286,0.00005117921,0.001202702],"genre_scores_gemma":[0.9724663,0.00002723102,0.01405176,0.003307123,0.0003088077,0.00295295,0.0008814207,0.00003516754,0.005969252],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2092778,"threshold_uncertainty_score":0.9994705,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4407793778","doi":"10.1080/02602938.2025.2467647","title":"Self-assessment design in a digital world: centring student agency","year":2025,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Innovative Teaching and Learning Methods","field":"Psychology","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ontario Tech University","funders":"","keywords":"Centring; Agency (philosophy); Pedagogy; Psychology; Higher education; Mathematics education; Sociology; Engineering; Political science; Social science","authors":[{"name":"Juuso Henrik Nieminen","is_ca":true},{"name":"Zi Yan","is_ca":false},{"name":"David Boud","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1011269683007894,"gpt":0.5256117004833262,"spread":0.4244847321825367,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.007293364,0.0002233815,0.0002536759,0.001327022,0.0001166877,0.0001684222,0.0002478524,0.0001018073,0.00192592],"category_scores_gemma":[0.0000657355,0.0002402052,0.00004772728,0.001990041,0.00002158104,0.0003132381,0.00005381479,0.000577623,0.00004530974],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002718464,"about_ca_system_score_gemma":0.001492627,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009443933,"about_ca_topic_score_gemma":0.00001176373,"domain_scores_codex":[0.9949208,0.002767413,0.000754438,0.0005840469,0.0006008797,0.0003724236],"domain_scores_gemma":[0.9984362,0.0005690297,0.0002590989,0.0004157984,0.0002805237,0.00003932857],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002182354,0.002664872,0.7910442,0.00002825713,0.00007605596,0.000001627482,0.004411689,0.001119613,0.0001246468,0.1135345,0.001490033,0.08548266],"study_design_scores_gemma":[0.001299819,0.00005682939,0.9805211,0.0001394638,0.0000472568,4.733948e-7,0.001023645,0.001135451,0.000008332275,0.008272449,0.00729104,0.0002040917],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6884228,0.0004069371,0.02809792,0.002652789,0.007591743,0.002290021,0.00000142299,0.0001608692,0.2703755],"genre_scores_gemma":[0.9612868,0.000005218812,0.02616124,0.0003170358,0.000149298,0.001323767,0.00006875086,0.00002162298,0.0106663],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2728639,"threshold_uncertainty_score":0.9989865,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2060845473","doi":"10.1080/02602930701772754","title":"Telling the second half of the story: linking academic development to student experience of learning","year":2008,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University","funders":"","keywords":"Psychology; Value (mathematics); Higher education; Pedagogy; Mathematics education; Computer science; Political science","authors":[{"name":"Lynn McAlpine","is_ca":true},{"name":"Gloria Berdugo Oviedo","is_ca":true},{"name":"Andrea Emrick","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.258701240075958,"gpt":0.5317956474131663,"spread":0.2730944073372083,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009443984,0.0000942645,0.0001268213,0.0001371393,0.0008116438,0.00002756265,0.0005100977,0.00007507235,0.0007744054],"category_scores_gemma":[0.0006065645,0.00007276428,0.00003551957,0.0005793218,0.0001355403,0.000408532,0.00007353123,0.0004484243,0.000009506915],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007343085,"about_ca_system_score_gemma":0.002810099,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003090236,"about_ca_topic_score_gemma":0.0002965511,"domain_scores_codex":[0.9947731,0.002401926,0.0005222932,0.0002255195,0.001911997,0.0001651645],"domain_scores_gemma":[0.9978186,0.0007224099,0.0007017745,0.0002271237,0.0004906068,0.0000395172],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000005745348,0.0002018302,0.6434925,0.00001786293,0.00001871479,3.504632e-8,0.3286815,0.008935235,0.002175016,0.00846707,0.0001738083,0.007830717],"study_design_scores_gemma":[0.0001433151,0.00001955291,0.8957646,0.000124609,0.00002138892,2.966606e-7,0.02968857,0.000169964,0.0008863327,0.0002075396,0.07287934,0.00009452236],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9824405,0.0002170035,0.0001222583,0.008902817,0.001323255,0.0008868166,2.033415e-7,0.00001437431,0.006092747],"genre_scores_gemma":[0.9935571,0.00002999717,0.001717084,0.0001914888,0.0001447924,0.0002960373,0.000004497723,0.000008695887,0.004050329],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2989929,"threshold_uncertainty_score":0.8479196,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4387267871","doi":"10.1080/02602938.2023.2263668","title":"Flexible assessment: some benefits and costs for students and instructors","year":2023,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Grading (engineering); Workload; Flexibility (engineering); Rigour; Formative assessment; Psychology; Medical education; Mathematics education; Pedagogy; Computer science; Engineering; Management; Medicine","authors":[{"name":"Mairi Cowan","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2742143064569399,"gpt":0.5825374862958459,"spread":0.3083231798389059,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008769674,0.0001353887,0.0001551822,0.000406448,0.0005706951,0.0003869269,0.0001841109,0.0001086423,0.0002505668],"category_scores_gemma":[0.0004428992,0.0001524707,0.00002371477,0.0005284335,0.00008570851,0.001645508,0.00006721316,0.0001501915,0.00001175935],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008181626,"about_ca_system_score_gemma":0.001197883,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007788041,"about_ca_topic_score_gemma":0.0002575704,"domain_scores_codex":[0.9966854,0.0009370854,0.0003586373,0.0004103668,0.001345868,0.0002626148],"domain_scores_gemma":[0.9982723,0.0008162633,0.0002815712,0.0001722369,0.0003486293,0.0001090118],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000008837269,0.0001981262,0.5815931,0.00002665468,0.00002632648,5.477712e-8,0.00294849,0.0001591607,0.00007255514,0.2917919,0.001591317,0.1215835],"study_design_scores_gemma":[0.0008624863,0.00005516007,0.9669791,0.00007540517,0.00007276206,1.956952e-7,0.003677115,0.000927736,0.000007915244,0.01539889,0.01177665,0.0001665297],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9708639,0.0004178045,0.00001938618,0.01948556,0.002148075,0.001767118,0.000006971615,0.0001172684,0.005173947],"genre_scores_gemma":[0.9927557,0.0005610812,0.002606141,0.0003258073,0.0003404812,0.001025432,0.0001572424,0.00001951313,0.002208599],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.385386,"threshold_uncertainty_score":0.6217576,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2983876144","doi":"10.1080/02602938.2019.1689381","title":"The effects of perceived professor competence, warmth and gender on students’ likelihood to register for a course","year":2019,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Communication in Education and Healthcare","field":"Psychology","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"Carleton University","funders":"","keywords":"Vignette; Psychology; Gender bias; Competence (human resources); Social psychology; Developmental psychology","authors":[{"name":"Nina Nesdoly","is_ca":true},{"name":"Christine Tulk","is_ca":true},{"name":"Janet Mantler","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1071291118785418,"gpt":0.527350665480816,"spread":0.4202215536022742,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001534679,0.000131885,0.000174134,0.0001499903,0.000147822,0.00005155479,0.0003139023,0.00008329336,0.0005544685],"category_scores_gemma":[0.00007047956,0.0001102662,0.00003829256,0.0002396008,0.00003728657,0.00007457915,0.00004207477,0.0001641545,0.00005734999],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002801551,"about_ca_system_score_gemma":0.0006382452,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004789287,"about_ca_topic_score_gemma":0.00003900224,"domain_scores_codex":[0.9978139,0.0006967881,0.0004464026,0.0003298476,0.0004985312,0.0002145193],"domain_scores_gemma":[0.9971941,0.001110358,0.0002770707,0.0007649112,0.0005735753,0.00007999627],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002154893,0.003244175,0.7723192,0.0004238043,0.0001146299,4.567049e-8,0.02759717,0.00001343494,0.0007884201,0.1374228,0.02021392,0.03764698],"study_design_scores_gemma":[0.00126055,0.0003143332,0.9767296,0.0001263069,0.00005196441,3.731937e-7,0.005187521,0.00005473108,0.000007545964,0.003411979,0.01274181,0.000113257],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9641702,0.0005051488,0.00002252456,0.01694573,0.005145296,0.005177502,0.00000331309,0.00001725547,0.008013102],"genre_scores_gemma":[0.9829445,0.00004809137,0.0007210022,0.001640652,0.0001151762,0.004749417,0.00005963923,0.00001984369,0.009701698],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2044104,"threshold_uncertainty_score":0.6071042,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4386923563","doi":"10.1080/02602938.2023.2259632","title":"Are assessment accommodations cheating? A critical policy analysis","year":2023,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Disability Education and Employment","field":"Social Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary; Ontario Tech University","funders":"","keywords":"Cheating; Accommodation; Psychology; Context (archaeology); Realm; Inclusion (mineral); Public relations; Reasonable accommodation; Social psychology; Political science; Law","authors":[{"name":"Juuso Henrik Nieminen","is_ca":true},{"name":"Sarah Elaine Eaton","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2102170293723387,"gpt":0.577718254142636,"spread":0.3675012247702973,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.004506215,0.0001612955,0.0002461641,0.001237992,0.0006042375,0.0003203129,0.0002773675,0.0001222282,0.008070788],"category_scores_gemma":[0.001098205,0.0001843003,0.0001304826,0.006238456,0.0001629193,0.0005820754,0.00004924185,0.0001957047,0.0001807031],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002965568,"about_ca_system_score_gemma":0.004921441,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004107979,"about_ca_topic_score_gemma":0.003008644,"domain_scores_codex":[0.9957323,0.001292142,0.0005742974,0.0004825582,0.00148246,0.0004362217],"domain_scores_gemma":[0.997732,0.0006142507,0.0002559493,0.0004637604,0.000733443,0.0002006058],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000002025997,0.001162647,0.6979384,0.00001817451,0.00007363754,1.390833e-7,0.004202398,0.001210056,0.00001769382,0.2790315,0.009830084,0.006513316],"study_design_scores_gemma":[0.0001895284,0.00001194383,0.9379302,0.00002549444,0.000221786,5.21755e-8,0.01504066,0.002093713,0.000001472535,0.02198887,0.0223179,0.0001783951],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5376583,0.00003603098,0.0002424642,0.304727,0.003047298,0.001467377,0.00001737196,0.0003132071,0.1524908],"genre_scores_gemma":[0.9891775,0.0000245325,0.001187896,0.001190276,0.0007082488,0.001843825,0.00044314,0.0000159529,0.005408576],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4515192,"threshold_uncertainty_score":0.992836,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2705397363","doi":"10.1080/02602938.2017.1343799","title":"Comparing student, instructor, classroom and institutional data to evaluate a seven-year department-wide science education initiative","year":2017,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Helpfulness; Enthusiasm; Graduation (instrument); Psychology; Medical education; Perception; Class (philosophy); Class size; Higher education; Mathematics education; Medicine; Social psychology; Computer science; Political science","authors":[{"name":"Francis Jones","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4177558026403005,"gpt":0.5790085889658491,"spread":0.1612527863255485,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["sts","scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.01362191,0.0002003535,0.0002162913,0.0005250918,0.002976442,0.001443509,0.001446197,0.00008692776,0.0004978259],"category_scores_gemma":[0.004108587,0.0002267803,0.00002348381,0.0004938287,0.0005588583,0.006167211,0.0005564046,0.000290283,0.00006660615],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002460761,"about_ca_system_score_gemma":0.01963882,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002171697,"about_ca_topic_score_gemma":0.002786822,"domain_scores_codex":[0.9942011,0.001225094,0.0005676752,0.0008724444,0.002764853,0.0003688574],"domain_scores_gemma":[0.9962173,0.0003595054,0.0007728167,0.001142102,0.00126001,0.0002483256],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001337296,0.0005882845,0.8821089,0.00001299239,0.00002420461,1.416331e-7,0.006563823,0.0002291555,0.0001009342,0.08731863,0.001239613,0.02179993],"study_design_scores_gemma":[0.0006759099,0.00003888743,0.9670017,0.000133687,0.00009881621,5.613076e-7,0.006686409,0.001479652,0.00001106529,0.004942663,0.01868727,0.000243383],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9052697,0.0001016619,0.00009036717,0.02006689,0.004199828,0.001747912,0.000009687499,0.00004482176,0.06846917],"genre_scores_gemma":[0.9865355,0.00005248761,0.01089056,0.0007261343,0.0004842406,0.0004481065,0.0002244331,0.0000147901,0.000623686],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.08489279,"threshold_uncertainty_score":0.9995931,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4402198693","doi":"10.1080/02602938.2024.2388699","title":"‘There was very little room for me to be me’: the lived tensions between assessment standardisation and student diversity","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Higher Education Learning Practices","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ontario Tech University","funders":"Curtin University of Technology","keywords":"Diversity (politics); Pedagogy; Psychology; Higher education; Lived experience; Sociology; Mathematics education; Political science","authors":[{"name":"Juuso Henrik Nieminen","is_ca":true},{"name":"Mollie Dollinger","is_ca":false},{"name":"Rachel Finneran","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1927564632755125,"gpt":0.5260661712831748,"spread":0.3333097080076622,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["sts","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006760556,0.00017177,0.0001887856,0.0002089075,0.001314955,0.0006492446,0.0002803476,0.0001171225,0.001044003],"category_scores_gemma":[0.0003205893,0.0001513854,0.00006248107,0.0006728994,0.00008315453,0.0008505575,0.0001363881,0.0002747063,0.00002498394],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001934658,"about_ca_system_score_gemma":0.002856965,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001153231,"about_ca_topic_score_gemma":0.0004806448,"domain_scores_codex":[0.9959916,0.001387637,0.0003884975,0.0005123046,0.001435547,0.0002844031],"domain_scores_gemma":[0.9968231,0.001881327,0.0001890009,0.0002956666,0.0006640393,0.0001468054],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001866895,0.0004992527,0.7783059,0.00007268939,0.0001840171,3.037137e-7,0.1266923,0.0006434488,0.0001526454,0.0541143,0.02069101,0.0186254],"study_design_scores_gemma":[0.0002118485,0.0000689933,0.7762248,0.00007533116,0.0002385599,1.315657e-7,0.026371,0.0002002559,0.000004860452,0.002777186,0.1936698,0.0001572757],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8306583,0.0005231475,0.001073691,0.1555223,0.003788918,0.002779771,0.00002123615,0.0001041181,0.005528467],"genre_scores_gemma":[0.9903473,0.00009046143,0.0026016,0.0005755392,0.0008375627,0.000998892,0.0001483861,0.00002236717,0.004377901],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1729788,"threshold_uncertainty_score":0.9999852,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4396978195","doi":"10.1080/02602938.2024.2350682","title":"Conflict management styles assessment and feedback for student self-awareness and team development","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Conflict Management and Negotiation","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Windsor; University of Ottawa; University of Winnipeg; University of Calgary","funders":"","keywords":"Psychology; Conflict management; Applied psychology; Medical education; Political science; Medicine","authors":[{"name":"Tom O’Neill","is_ca":true},{"name":"Aliza J. Aldana","is_ca":true},{"name":"Jose A. Espinoza","is_ca":true},{"name":"McKenna P. Sperry","is_ca":true},{"name":"Kyle Brykman","is_ca":true},{"name":"Magda Donia","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.09251670516487259,"gpt":0.4803643808056817,"spread":0.3878476756408091,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003116945,0.0001790208,0.0001619743,0.0003720295,0.0004317271,0.0005940514,0.0001286265,0.00007879656,0.0003043442],"category_scores_gemma":[0.000007363335,0.0001886134,0.00002853125,0.0003674539,0.00004605288,0.0005218552,0.00007431846,0.00009155897,0.000007142474],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001234422,"about_ca_system_score_gemma":0.001100975,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001257356,"about_ca_topic_score_gemma":0.0002455843,"domain_scores_codex":[0.9977034,0.0002754579,0.0004100971,0.0005096658,0.0008421639,0.0002592548],"domain_scores_gemma":[0.9992368,0.0002105428,0.0001110767,0.0001530486,0.0002052279,0.00008330696],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.00001214944,0.0007221723,0.1902592,0.0005376711,0.0002508477,6.127558e-7,0.02269577,0.00005269271,0.00004966693,0.5079575,0.004362877,0.2730989],"study_design_scores_gemma":[0.0005150768,0.00003023323,0.7144461,0.0001307839,0.0001464398,1.327735e-7,0.006795662,0.001806409,0.000005442542,0.001384725,0.2745493,0.0001896957],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8818933,0.002272813,0.001690029,0.01094998,0.003546751,0.007132242,0.000004418446,0.000295566,0.09221495],"genre_scores_gemma":[0.9847453,0.0008227784,0.006736162,0.0001821625,0.0002529604,0.002418755,0.0001233225,0.00001987216,0.00469869],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5241869,"threshold_uncertainty_score":0.7691432,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4404012066","doi":"10.1080/02602938.2024.2419604","title":"The paradox of inclusive assessment","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Higher Education Learning Practices","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ontario Tech University","funders":"","keywords":"Psychology; Pedagogy; Higher education; Mathematics education; Evaluation methods; Political science","authors":[{"name":"Juuso Henrik Nieminen","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07941909821958311,"gpt":0.5416770865350428,"spread":0.4622579883154597,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.007689833,0.0001220559,0.0001303496,0.0001904493,0.0005600943,0.0003870326,0.0003253153,0.00009628107,0.002860723],"category_scores_gemma":[0.0003078146,0.0001039543,0.00005689187,0.001102339,0.0001872805,0.000808847,0.00003996648,0.0003232301,0.00006946822],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001607902,"about_ca_system_score_gemma":0.009480536,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001233681,"about_ca_topic_score_gemma":0.0003632747,"domain_scores_codex":[0.9954526,0.001981338,0.000518235,0.0003236255,0.001471936,0.0002522045],"domain_scores_gemma":[0.9968857,0.001829531,0.0002953807,0.0003164332,0.0006019811,0.00007097411],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000006071895,0.000427131,0.06372272,0.00004345373,0.00005450255,3.158986e-7,0.01909046,0.0004294134,0.000154137,0.8260987,0.01174059,0.07823253],"study_design_scores_gemma":[0.0001096119,0.00002626649,0.3964165,0.00008942908,0.00006165051,2.638427e-7,0.007643959,0.0006919176,0.000010284,0.01604071,0.5787998,0.0001095541],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.3258141,0.004708226,0.0002595627,0.2087306,0.02131283,0.002492737,0.000004018771,0.0001883808,0.4364895],"genre_scores_gemma":[0.9847703,0.000307661,0.001418607,0.0001577486,0.0006265626,0.0007412565,0.00003735895,0.00001717932,0.01192332],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8100579,"threshold_uncertainty_score":0.9980508,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2119158672","doi":"10.1080/02602938.2012.693906","title":"Interpreting differences between the United States and New Zealand university students’ engagement scores as measured by the NSSE and AUSSE","year":2012,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Higher Education Research Studies","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"University of Auckland; National Center For Environmental Assessment; University of Victoria","keywords":"Student engagement; Constructive; Psychology; Scale (ratio); Medical education; Mathematics education; Medicine; Geography; Computer science; Process (computing)","authors":[{"name":"Erik Brogt","is_ca":false},{"name":"Keith Comer","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1322003794510495,"gpt":0.4711410347303959,"spread":0.3389406552793465,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005470608,0.0001184641,0.000115298,0.0001390657,0.0008931349,0.0002712955,0.0002864155,0.00004628728,0.0003646015],"category_scores_gemma":[0.0002239663,0.00008125641,0.00001548275,0.0005310907,0.0002672751,0.0003843048,0.000116848,0.0002122841,0.000005583537],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000436435,"about_ca_system_score_gemma":0.0006272208,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01674822,"about_ca_topic_score_gemma":0.0007446633,"domain_scores_codex":[0.9956481,0.002597928,0.0001955652,0.0002070547,0.001073481,0.000277823],"domain_scores_gemma":[0.9979967,0.001296379,0.000146479,0.0001611273,0.0002545099,0.000144789],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000005228944,0.0001052367,0.9329675,0.000004588383,0.00004012417,1.778766e-8,0.04982849,0.000003245838,0.000009990704,0.002246334,0.01173107,0.00305817],"study_design_scores_gemma":[0.0002435337,0.00002607846,0.8932315,0.00003279482,0.00006952247,6.811702e-8,0.04662518,0.00001837009,0.000004282617,0.001121496,0.058541,0.00008623001],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9603316,0.0006710184,0.00001869245,0.03651253,0.0004231525,0.0008897103,0.000003153737,0.00001937033,0.001130812],"genre_scores_gemma":[0.9931257,0.0007413542,0.00007162103,0.0002266845,0.000226421,0.00007972783,0.00005209562,0.000006359132,0.005470047],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04680993,"threshold_uncertainty_score":0.9897993,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4402798678","doi":"10.1080/02602938.2024.2402956","title":"Connecting students’ descriptions of classroom assessment in higher education with wellness","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Alberta","funders":"","keywords":"Psychology; Higher education; Pedagogy; Mathematics education; Medical education; Medicine","authors":[{"name":"Lia M. Daniels","is_ca":true},{"name":"Kendra Wells","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1083461691642832,"gpt":0.4722726356939878,"spread":0.3639264665297046,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003671447,0.0002616199,0.0003158285,0.0008008915,0.0002657961,0.0004682457,0.0004209279,0.0001756245,0.005809998],"category_scores_gemma":[0.00003322743,0.0002618079,0.00007477852,0.001973497,0.00009748338,0.001168168,0.00006098799,0.0004228998,0.00002919496],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002864198,"about_ca_system_score_gemma":0.006035238,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002085389,"about_ca_topic_score_gemma":0.001879899,"domain_scores_codex":[0.9951348,0.0009686089,0.0007892225,0.0006196498,0.002080954,0.0004067894],"domain_scores_gemma":[0.9983947,0.0003643012,0.0003064319,0.0003337024,0.0004958845,0.0001049489],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001714018,0.002199733,0.7342402,0.0001066724,0.0000713238,9.113738e-7,0.007575729,0.0003874157,0.0003412469,0.2364412,0.001524043,0.01709443],"study_design_scores_gemma":[0.0007089061,0.00008866929,0.9484112,0.0006199371,0.0001526798,5.022978e-7,0.02116034,0.0004196588,0.00001468325,0.006377486,0.0217311,0.0003147954],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8661386,0.000762841,0.0001597378,0.009876586,0.008193729,0.002107327,0.000004345092,0.0001076806,0.1126491],"genre_scores_gemma":[0.9851868,0.0001062128,0.002138574,0.0001495515,0.0006376542,0.001228575,0.0001705372,0.00003865529,0.01034349],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2300637,"threshold_uncertainty_score":0.9999834,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2401839864","doi":"10.1080/02602938.2016.1188057","title":"Impact assessment of a department-wide science education initiative using students’ perceptions of teaching and learning experiences","year":2016,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Evaluation of Teaching Practices","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Helpfulness; Context (archaeology); Psychology; Perception; Medical education; Preference; Science education; Class (philosophy); Teaching method; Mathematics education; Medicine; Computer science","authors":[{"name":"Francis Jones","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1817612835993253,"gpt":0.5919669342211382,"spread":0.4102056506218129,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01562243,0.0001525677,0.000221824,0.0006681596,0.0008688761,0.0001470742,0.000330812,0.00007069694,0.00106434],"category_scores_gemma":[0.002515879,0.0001296165,0.00005028898,0.0006438966,0.0005395298,0.002585509,0.00008129002,0.0002652956,0.000001638357],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002174638,"about_ca_system_score_gemma":0.01187888,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00205402,"about_ca_topic_score_gemma":0.0001014687,"domain_scores_codex":[0.9925905,0.003774681,0.0006498066,0.000419896,0.002306478,0.0002586739],"domain_scores_gemma":[0.9962811,0.001286675,0.001008055,0.000227347,0.001086029,0.0001107173],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000004590525,0.0007967736,0.9327905,0.00001186348,0.00001948075,1.915164e-8,0.0357873,0.0002314209,0.004010428,0.009863156,0.00002986282,0.0164546],"study_design_scores_gemma":[0.0003478305,0.0001248166,0.9168465,0.0002297889,0.00007711832,3.238717e-7,0.08032297,0.0005833139,0.00004761149,0.001103192,0.0001801006,0.0001364614],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9869109,0.00008372218,0.0007259619,0.001677221,0.000780937,0.0008831343,0.000001769336,0.00002180033,0.00891454],"genre_scores_gemma":[0.9858087,0.00005026816,0.01336878,0.00005515645,0.0001076904,0.0002988747,0.00001357248,0.00001134772,0.0002856431],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04453567,"threshold_uncertainty_score":0.9998488,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4402556220","doi":"10.1080/02602938.2024.2400349","title":"Feedback practices in clinical placement: how students come to understand how they are progressing","year":2024,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Psychology; Mathematics education; Pedagogy; Higher education; Advanced Placement; Medical education; Medicine; Political science","authors":[{"name":"Kelli Nicola‐Richmond","is_ca":false},{"name":"Nikki Lyons","is_ca":false},{"name":"Natalie Ward","is_ca":false},{"name":"Sally Logan","is_ca":false},{"name":"Rola Ajjawi","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.287976591638158,"gpt":0.57342609451059,"spread":0.285449502872432,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.009019918,0.0002194861,0.0002803027,0.0004789942,0.0002606064,0.002221458,0.0004602725,0.0001740526,0.0006111505],"category_scores_gemma":[0.0003759415,0.0002189967,0.0000745709,0.001109964,0.00008682132,0.001533879,0.0001007474,0.0003884985,0.0000541964],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002197557,"about_ca_system_score_gemma":0.001896304,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002773158,"about_ca_topic_score_gemma":0.002712175,"domain_scores_codex":[0.9942298,0.001746331,0.0005285681,0.0006874583,0.002376453,0.0004313903],"domain_scores_gemma":[0.9980715,0.000673508,0.0005196324,0.0002765974,0.0003086214,0.0001501694],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0000271782,0.001051033,0.9625376,0.0000513131,0.00005609956,0.000002527116,0.01423205,0.00005388881,0.00002129914,0.007536715,0.006110632,0.0083196],"study_design_scores_gemma":[0.0007651558,0.00009047908,0.9090406,0.0004876791,0.00008855169,1.958612e-7,0.06875982,0.0003584632,0.000001388693,0.001840712,0.01831125,0.0002556496],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8896041,0.0006415185,0.00005843484,0.08524258,0.006154114,0.002705084,0.000002951247,0.00009381527,0.01549741],"genre_scores_gemma":[0.9903855,0.0001815246,0.0009283224,0.0003360614,0.000891719,0.0004965505,0.00005191211,0.00002652833,0.00670192],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1007814,"threshold_uncertainty_score":0.9988143,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2073387991","doi":"10.1080/02602938.2014.911244","title":"Record of assessment moderation practice (RAMP): survey software as a mechanism of continuous quality improvement","year":2014,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"University of Alberta","keywords":"Moderation; Quality (philosophy); Identification (biology); Quality management; Process (computing); Unit (ring theory); Psychology; Computer science; Process management; Applied psychology; Operations management; Engineering; Mathematics education; Social psychology","authors":[{"name":"Genevieve Marie Johnson","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.107120622134603,"gpt":0.4962321905641408,"spread":0.3891115684295378,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.01696742,0.0002116713,0.0004409871,0.0002566142,0.0002129065,0.0001154378,0.0003125108,0.0001799368,0.001369642],"category_scores_gemma":[0.001416284,0.0002317308,0.0000912797,0.0006266368,0.00009478239,0.0008686189,0.00006137231,0.0002045156,0.000009775086],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001040782,"about_ca_system_score_gemma":0.002858989,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01767194,"about_ca_topic_score_gemma":0.002229922,"domain_scores_codex":[0.9916078,0.004005195,0.001222615,0.0004851109,0.002370533,0.000308753],"domain_scores_gemma":[0.9940732,0.001510601,0.001478395,0.0004391282,0.0024059,0.00009283395],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.0001235714,0.003614496,0.3628463,0.0001083053,0.000137444,1.037603e-7,0.006242143,0.0002399175,0.004234096,0.5362723,0.0008422037,0.08533919],"study_design_scores_gemma":[0.001426031,0.0004664699,0.95401,0.00009197699,0.000159235,1.20047e-7,0.007570669,0.001213175,0.0003000273,0.03202697,0.00241343,0.0003219526],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9069546,0.00006535163,0.01565744,0.003623755,0.003940749,0.003201575,0.00001505286,0.00006650467,0.06647494],"genre_scores_gemma":[0.9796294,0.00007284778,0.01774114,0.0002787189,0.000213211,0.000519309,0.0002580816,0.00002024834,0.001267029],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5911637,"threshold_uncertainty_score":0.9995432,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4411702131","doi":"10.1080/02602938.2025.2524095","title":"The role of digital technology in authentic assessment: perspectives of university educators","year":2025,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Northern British Columbia","funders":"","keywords":"Higher education; Pedagogy; Technology integration; Psychology; Technological literacy; Mathematics education; Educational technology; Sociology; Engineering ethics; Medical education; Engineering; Political science; Medicine","authors":[{"name":"Anjin Hu","is_ca":false},{"name":"Qian Liu","is_ca":false},{"name":"Ben Kei Daniel","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02003120218494171,"gpt":0.4013315858594782,"spread":0.3813003836745365,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001737068,0.0000935868,0.0001637444,0.00064958,0.0001859501,0.0000528939,0.0003637788,0.0000991389,0.0002252865],"category_scores_gemma":[0.0001176624,0.00009138804,0.00004902638,0.001869824,0.0003004583,0.0003662073,0.00005930271,0.0001508806,0.000001884292],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001189209,"about_ca_system_score_gemma":0.003611867,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005209675,"about_ca_topic_score_gemma":0.000337256,"domain_scores_codex":[0.9982409,0.0004343379,0.0003429535,0.0002270146,0.0005667689,0.0001880335],"domain_scores_gemma":[0.9987124,0.0003637241,0.0002590387,0.0002223978,0.00041998,0.00002246281],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000007038672,0.000442665,0.5181791,0.000005257651,0.00001775325,2.665968e-8,0.004031011,0.000009446898,0.0001115553,0.4704014,0.00004808499,0.006746643],"study_design_scores_gemma":[0.0003097899,0.00001993429,0.698598,0.00005164179,0.00003542121,1.850494e-8,0.2288894,0.00009931581,0.00002851042,0.06774849,0.004157365,0.00006216076],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7977895,0.0005710361,0.00001531409,0.007047066,0.0007123656,0.0006962886,0.000002003636,0.00001606967,0.1931504],"genre_scores_gemma":[0.9967351,0.0001359156,0.0001916124,0.000006614732,0.00003477207,0.00005093619,0.00001111179,0.000004499231,0.00282945],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4026529,"threshold_uncertainty_score":0.6407297,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4416613148","doi":"10.1080/02602938.2025.2587246","title":"What should we be assessing exactly? Higher education staff narratives on gen AI integration of assessment in a postplagiarism era","year":2025,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Calgary Laboratory Services; Brock University; University of Calgary","funders":"","keywords":"Higher education; Narrative; Qualitative research; Professional development; Semi-structured interview; Focus group; Educational assessment","authors":[{"name":"Sarah Elaine Eaton","is_ca":true},{"name":"Beatriz Moya Figueroa","is_ca":false},{"name":"Brenda McDermott","is_ca":true},{"name":"Rahul Kumar","is_ca":true},{"name":"Robert W. Brennan","is_ca":true},{"name":"Jason Wiens","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1128112722653669,"gpt":0.4954028071868408,"spread":0.3825915349214739,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006313928,0.0003390222,0.0004279833,0.001175366,0.0003614619,0.0005433304,0.0004172318,0.0009324633,0.002461789],"category_scores_gemma":[0.0002046023,0.0003505508,0.000099832,0.001657201,0.0001776194,0.003297493,0.00004791109,0.002105267,0.000007966151],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003698055,"about_ca_system_score_gemma":0.01197936,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002945645,"about_ca_topic_score_gemma":0.001234901,"domain_scores_codex":[0.9930885,0.002947254,0.001120415,0.000686025,0.001734975,0.0004228311],"domain_scores_gemma":[0.9970575,0.0006961958,0.000623391,0.0004119959,0.001111712,0.0000991878],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","study_design_scores_codex":[0.00006242713,0.00358112,0.02445444,0.000115606,0.00006542753,4.58381e-7,0.03261785,0.0005876833,0.003047376,0.7837499,0.02250677,0.1292109],"study_design_scores_gemma":[0.001032031,0.0001592426,0.6647667,0.00261934,0.0001212115,3.421576e-7,0.1155022,0.001277647,0.0004483693,0.1477941,0.06572633,0.0005525155],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5385379,0.001419474,0.0008999713,0.2981523,0.01665317,0.003179238,0.00001104099,0.00008901145,0.141058],"genre_scores_gemma":[0.9815541,0.0005632706,0.00313843,0.003691182,0.0004630474,0.0008635154,0.0003892441,0.00002335266,0.009313853],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6403123,"threshold_uncertainty_score":0.9998946,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4366159769","doi":"10.1080/02602938.2023.2199181","title":"Students’ online evaluation of teaching and system continuance usage intention: new directions from a multidisciplinary perspective","year":2023,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Online and Blended Learning","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"National Science and Technology Council","keywords":"Helpfulness; CLARITY; Set (abstract data type); Continuance; Psychology; Perspective (graphical); Higher education; Medical education; Knowledge management; Computer science; Social psychology; Political science","authors":[{"name":"Hui-Chih Wang","is_ca":false},{"name":"Rachael Ehianeta","is_ca":false},{"name":"Her‐Sen Doong","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.106275688017859,"gpt":0.5058444972128289,"spread":0.3995688091949698,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007327515,0.0001151772,0.0001817373,0.0003353506,0.0004041275,0.00009344107,0.000146013,0.00008845746,0.0003620656],"category_scores_gemma":[0.0004965949,0.0001251267,0.00004428991,0.0007105838,0.00005753447,0.0005252253,0.00005711201,0.0002663859,0.0000112534],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001481829,"about_ca_system_score_gemma":0.002272896,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009359992,"about_ca_topic_score_gemma":0.003055866,"domain_scores_codex":[0.995113,0.002323764,0.0004146424,0.0003735618,0.001600753,0.0001743417],"domain_scores_gemma":[0.9981785,0.0003511173,0.0003205356,0.0001742459,0.0009040913,0.00007151281],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00002823419,0.001282566,0.6579407,0.00004204456,0.0001221138,4.681403e-7,0.04162786,0.001445978,0.0009930476,0.04275795,0.001061627,0.2526974],"study_design_scores_gemma":[0.0008007569,0.00003320967,0.8515886,0.0002646535,0.0001917323,1.652772e-7,0.1294447,0.0112797,0.000005498697,0.004470675,0.001805705,0.0001146565],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9817864,0.0004915098,0.00008465673,0.005174377,0.001671314,0.001057662,0.000009977528,0.00009812213,0.009625957],"genre_scores_gemma":[0.9929323,0.00007008986,0.003169783,0.00001404192,0.0005677943,0.0002118668,0.0002447543,0.00001240994,0.002776951],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2525828,"threshold_uncertainty_score":0.9972368,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3184059431","doi":"10.1080/02602938.2021.1956428","title":"Patterns of special consideration requests at a UK university: reasons given and associations with demographic factors","year":2021,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Medical Education and Admissions","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"","keywords":"Psychology; Quarter (Canadian coin); Mental health; Control (management); Medical education; Medicine; Psychiatry","authors":[{"name":"Paul E. Jenkins","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.06568450014595346,"gpt":0.3824971704876142,"spread":0.3168126703416608,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.000372333,0.0001093851,0.000204991,0.0002369902,0.0001211197,0.00001996238,0.00003113123,0.00009578741,0.00838862],"category_scores_gemma":[0.0004345416,0.0001031541,0.00003791725,0.0004630183,0.00004787459,0.0001304979,0.00002048592,0.0001474276,0.000002302291],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005586074,"about_ca_system_score_gemma":0.00437739,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009186821,"about_ca_topic_score_gemma":0.0003212947,"domain_scores_codex":[0.9984767,0.0002972406,0.0002744805,0.0002683612,0.000562505,0.0001206828],"domain_scores_gemma":[0.9984622,0.0002084646,0.000218508,0.0001990371,0.0006572014,0.0002546183],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001530729,0.0005043062,0.9871898,0.00003429858,0.0000463144,0.000001951573,0.0007775992,0.000007659979,0.0006823967,0.007157896,0.002610404,0.0009720915],"study_design_scores_gemma":[0.001124675,0.00007593591,0.9905629,0.0002238282,0.0002390845,0.00000784725,0.00217803,0.0000793509,0.0002067426,0.0004479206,0.004755245,0.00009845442],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9767166,0.00008329869,0.00006615331,0.01605878,0.0004822747,0.0004852754,0.00001837471,0.00001514255,0.006074107],"genre_scores_gemma":[0.9928163,0.0000864973,0.001210181,0.0003962788,0.000199105,0.00002234974,0.001016574,0.000009773934,0.004242952],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01609969,"threshold_uncertainty_score":0.9925178,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4408054097","doi":"10.1080/02602938.2025.2468848","title":"Enhancing the structure of feedback forms increases trustworthiness and usefulness of peer feedback","year":2025,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Peer feedback; Trustworthiness; Psychology; Peer evaluation; Peer review; Higher education; Negative feedback; Social psychology; Mathematics education; Political science; Engineering","authors":[{"name":"Jessica Quinton","is_ca":true},{"name":"Lorien Nesbitt","is_ca":true},{"name":"Johanna Bock","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03977582508428822,"gpt":0.4023611073920225,"spread":0.3625852823077343,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002363922,0.0001487864,0.000260949,0.0002338015,0.0002456795,0.00008624493,0.0002870875,0.0001228921,0.001005581],"category_scores_gemma":[0.0002194273,0.0001166176,0.00005111609,0.0009868171,0.0002179297,0.0004477041,0.00006857739,0.0001537426,0.000001010473],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002859648,"about_ca_system_score_gemma":0.001685153,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002156175,"about_ca_topic_score_gemma":0.002164967,"domain_scores_codex":[0.9972959,0.0004968161,0.0005790443,0.0002611306,0.001164889,0.0002021866],"domain_scores_gemma":[0.9978659,0.0004702287,0.0003930935,0.0002621295,0.0009704168,0.00003824278],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00003273552,0.0004030525,0.785737,0.0001093809,0.00007255455,4.722954e-8,0.008328027,0.0001097655,0.002667616,0.1936426,0.0009346095,0.007962586],"study_design_scores_gemma":[0.0006179263,0.00002157625,0.9642157,0.0001597776,0.0001320937,1.081232e-7,0.0162967,0.00007071331,0.0009426615,0.01587455,0.001550414,0.0001177659],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9792331,0.0002961981,0.00005870659,0.0039882,0.001201815,0.0009705766,0.000005709281,0.00001423138,0.01423148],"genre_scores_gemma":[0.9966348,0.00005879107,0.0004244213,0.0001331294,0.0001446432,0.00008417249,0.00005288856,0.000008691559,0.002458435],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1784786,"threshold_uncertainty_score":0.9999076,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4411690222","doi":"10.1080/02602938.2025.2523598","title":"Open book assessment: performance and student perceptions in a UK veterinary programme","year":2025,"lang":"en","type":"article","venue":"Assessment & Evaluation in Higher Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"","keywords":"Perception; Psychology; Medical education; Pedagogy; Medicine","authors":[{"name":"Erica Gummery","is_ca":false},{"name":"Kate Cobb","is_ca":false},{"name":"John Remnant","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08350136233889723,"gpt":0.5151767344608628,"spread":0.4316753721219656,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002597244,0.0001841632,0.000268631,0.0007841303,0.0001425526,0.0001605941,0.0002308686,0.0001317468,0.002015124],"category_scores_gemma":[0.00009309645,0.0001906094,0.00002541446,0.001316346,0.00008087508,0.0005603049,0.000154206,0.0004230686,0.00001170052],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002256204,"about_ca_system_score_gemma":0.003139161,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001195206,"about_ca_topic_score_gemma":0.00001958262,"domain_scores_codex":[0.9975964,0.0002640575,0.0007063995,0.0004914303,0.0006626579,0.0002790808],"domain_scores_gemma":[0.9989215,0.0000652323,0.0001618172,0.0004350228,0.0003673306,0.0000491248],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00003226612,0.002259134,0.8203323,0.0001680796,0.00002944047,6.627541e-7,0.0008049773,0.00003124806,0.0003785485,0.005992363,0.008815789,0.1611551],"study_design_scores_gemma":[0.002100653,0.0002477451,0.9699165,0.0006492113,0.00009601682,0.000005865448,0.002089849,0.004073289,0.000005257059,0.0007303096,0.01993449,0.0001507849],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9310804,0.0002656539,0.00007955747,0.01869196,0.001355243,0.003393171,7.935266e-7,0.00002836975,0.04510486],"genre_scores_gemma":[0.9749726,0.0001684785,0.009934559,0.003399993,0.0001224318,0.005021702,0.0003708091,0.00001628759,0.005993157],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1610044,"threshold_uncertainty_score":0.9988972,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}