{"id":"W2405300760","doi":"10.1097/00001888-200503000-00023","title":"The Dependability of Medical Students??? Performance Ratings as Documented on In-Training Evaluations","year":2005,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Medical Education and Admissions","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"Lakehead University","funders":"","keywords":"Dependability; Generalizability theory; Data collection; Variance (accounting); Computer science; Variance components; Nesting (process); Statistics; Software; Reliability engineering; Data mining; Mathematics; Software engineering; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05110608,0.0005076409,0.000631656,0.001586439,0.0004441949,0.001188269,0.0009096868,0.0005642145,0.001305494],"category_scores_gemma":[0.311147,0.0002815451,0.0008732649,0.001192263,0.001136567,0.001254615,0.002040993,0.001164321,0.0003309551],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009557155,"about_ca_system_score_gemma":0.0005397453,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002021411,"about_ca_topic_score_gemma":0.002323051,"domain_scores_codex":[0.9240081,0.03856159,0.006334014,0.004911351,0.0250106,0.001174298],"domain_scores_gemma":[0.5941348,0.2442915,0.06799262,0.05487899,0.03637756,0.002324537],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008495803,0.0002012428,0.9309887,0.0001787051,0.000609769,0.00004753442,0.003122008,0.001149937,0.002211043,0.0006205495,0.0005467115,0.05947417],"study_design_scores_gemma":[0.000009487267,0.0003247568,0.9943526,0.00002512875,0.00005815769,0.00006003192,0.0002214803,0.001747443,0.002340323,0.0002863627,0.0005536146,0.00002074199],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9690605,0.00024891,0.02219228,0.0001758081,0.00006690218,0.0003228609,0.0008262286,0.0001139469,0.006992552],"genre_scores_gemma":[0.9961195,0.00004343049,0.002892636,0.00002790252,0.00002403653,0.0001745808,0.0003442403,0.00002795982,0.0003458148],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.05110608,"threshold_uncertainty_score":0.270278,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06983833133914304,"score_gpt":0.500220328087687,"score_spread":0.430381996748544,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}