{"id":"W2150737588","doi":"10.1111/medu.12771","title":"Considerations in the use of reflective writing for student assessment: issues of reliability and validity","year":2015,"lang":"en","type":"article","venue":"Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":64,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; London Health Sciences Centre; Western University; Mount Saint Vincent University","funders":"","keywords":"Rubric; Reflective writing; Cronbach's alpha; Psychology; Reliability (semiconductor); Objective structured clinical examination; Intraclass correlation; Sample (material); Popularity; Reflective practice; Inter-rater reliability; Medical education; Psychometrics; Mathematics education; Clinical psychology; Social psychology; Pedagogy; Medicine; Developmental psychology; Rating scale","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.003011801,0.0000621492,0.0001910155,0.0001082072,0.00004086187,0.00001165349,0.00005531205,0.00008939339,0.00003734685],"category_scores_gemma":[0.03024627,0.00004545636,0.00002309858,0.0002936027,0.0002306675,0.0001070672,0.00001809327,0.0002021949,2.856943e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001257957,"about_ca_system_score_gemma":0.002077517,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002013599,"about_ca_topic_score_gemma":0.00002601206,"domain_scores_codex":[0.9984381,0.0002007003,0.0005207909,0.0001492732,0.000600719,0.00009041523],"domain_scores_gemma":[0.9978772,0.000729821,0.0001594896,0.0002401916,0.000948825,0.00004449493],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000109883,0.00800814,0.6937088,0.0007978959,0.00005255044,0.000001361259,0.03535526,0.00002500898,0.0003024756,0.03576985,0.1771141,0.04875473],"study_design_scores_gemma":[0.002149206,0.0007928861,0.9401422,0.000727314,0.0001473876,0.00004186127,0.02524723,0.002903329,0.0005273015,0.01357771,0.01360726,0.0001363491],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9621403,0.00008717181,0.001420262,0.03493472,0.0003188976,0.0007809948,0.000003031787,0.000007347608,0.00030726],"genre_scores_gemma":[0.9640385,0.00001983741,0.03257811,0.002949049,0.0001553008,0.0001718233,0.00005279468,0.000005238353,0.00002934265],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2464334,"threshold_uncertainty_score":0.9779224,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1504273781765615,"score_gpt":0.5128104933897941,"score_spread":0.3623831152132326,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}