{"id":"W2912476504","doi":"10.1111/medu.13801","title":"Accuracy of self‐monitoring: does experience, ability or case difficulty matter?","year":2019,"lang":"en","type":"article","venue":"Medical Education","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":30,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Seniority; Aptitude; Context (archaeology); Self-monitoring; Psychology; Psychological intervention; Confidence interval; Social psychology; Applied psychology; Medicine; Developmental psychology; Psychiatry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.004772696,0.0002100445,0.0004033041,0.0006090024,0.0001790138,0.001422969,0.0005639785,0.0006936011,0.002893491],"category_scores_gemma":[0.0490392,0.0001800392,0.0003913579,0.0006422183,0.0008419493,0.001111725,0.0007321614,0.0005821136,0.0004134116],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001971905,"about_ca_system_score_gemma":0.0002681482,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008500618,"about_ca_topic_score_gemma":0.001163564,"domain_scores_codex":[0.9975269,0.0009642927,0.0003352412,0.0003208744,0.000668893,0.0001837541],"domain_scores_gemma":[0.9346078,0.03919476,0.01946188,0.002188602,0.001974464,0.00257247],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001615509,0.00007719565,0.9914938,0.00003454188,0.00006801061,0.00002730927,0.000645012,0.00006245392,0.0002240699,0.00001913163,0.00005569089,0.007131225],"study_design_scores_gemma":[0.000003309033,0.0002186091,0.9983706,0.00002948061,0.00002320607,0.0001213967,0.0005680117,0.0002995815,0.0001633114,0.00005037588,0.0001458517,0.00000627822],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9984674,0.0003356833,0.0003168121,0.0001312818,0.000008806582,0.00000846378,0.000039769,0.000004293082,0.0006875322],"genre_scores_gemma":[0.999681,0.00007698994,0.00009367304,0.00001709049,0.000008196822,0.000003453442,0.00003353203,0.000002344001,0.00008373534],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9952273,"threshold_uncertainty_score":0.02524072,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01824775107992284,"score_gpt":0.3958603817714509,"score_spread":0.3776126306915281,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}